Skip to content

Latest commit

 

History

27 Commits

Folders and files

NameName
Last commit message
Last commit date
 
 
 
 
 
 
 
 
 
 

Repository files navigation

Complex Word Identification (CWI) for Lexical Simplification (LS) in Spanish texts for patients

Corpus and notebook consisting of a total of 225 texts made up of 75 clinical trials (CTs), 75 consent forms (CFs) and 75 patient information documents (PIDs), used in the MA thesis "Lexical Simplification in Spanish Texts for Patients: the Complex Word Identification Task".

Acknowledgements

This code is adapted from https://github.com/huggingface/notebooks/blob/main/examples/token_classification.ipynb

How to cite

If you use this data, please cite as follows:

@article{2025CWI,
  title={Complex Word Identification for Lexical Simplification in Spanish Texts for Patients},
  author={Ortega-Riba, Federico and Campillos-Llanos, Leonardo and Samy, Doaa},
  journal={Procesamiento del lenguaje natural},
  volume={74},
  year={2025}
}

About

No description, website, or topics provided.

Resources

Stars

0 stars

Watchers

1 watching

Forks

Releases

Packages

Contributors

Languages