Disease Risk Prediction Using Structured EHR Data: Can Generalist Large Language Models Match Specialized Clinical

Bingyu Mao1, Made K Prasadha1, Ziqian Xie1

  • 1McWilliams School of Biomedical Informatics, The University of Texas Health Science Center at Houston, Houston, TX, USA.

Summary

LLM-generated embeddings with simple classifiers surpassed specialized clinical foundation models (CFMs) and generalist large language models (LLMs) in disease risk prediction, offering a promising, cost-effective approach.