Benchmarking vision-language models for diagnostics in emergency and critical care settings

Christoph F Kurz1, Tatiana Merzhevich2, Bjoern M Eskofier2,3

  • 1Novartis Pharma GmbH, Nuremberg, Germany. christoph.kurz@novartis.com.

NPJ Digital Medicine
|July 10, 2025
PubMed
Summary

Vision-language models (VLMs) show limited diagnostic accuracy in acute care settings. Specialized training is needed to improve open-source VLMs for emergency and intensive care applications, as GPT-4o demonstrated superior performance.