Annotating longitudinal clinical narratives for de-identification: The 2014 i2b2/UTHealth corpus

Amber Stubbs1, Özlem Uzuner2

  • 1School of Library and Information Science, Simmons College, Boston, MA, USA.

Summary

Researchers created a de-identified medical record corpus for research. This dataset, derived from longitudinal records, aids natural language processing in protecting patient privacy while enabling data analysis.

Related Concept Videos