Evaluating large language model performance and reliability in scoring picture description tasks for

Michael J Kleiman1

  • 1Comprehensive Center for Brain Health, Department of Neurology, University of Miami Miller School of Medicine, Boca Raton, Florida, United States of America.

PLOS Digital Health
|April 21, 2026
PubMed
Abstract

Related Concept Videos