Interpreting psychiatric digital phenotyping data with large language models: a preliminary analysis.

Matthew Flathers1, Winna Xia1, Christine Hau1

  • 1Division of Digital Psychiatry at BIDMC, Harvard Medical School, Boston, Massachusetts, USA.

BMJ Mental Health
|September 24, 2025
PubMed
Summary

Large language models show promise in interpreting digital phenotyping data for behavioral health. GPT-4o achieved 52% accuracy, outperforming GPT-3.5-turbo, but human oversight remains crucial for clinical applications.

Related Concept Videos