Artificial Intelligence for Biomedical Diagnostics: Diagnostic Accuracy and Reliability of Multimodal Large Language

Henrik Stelling1,2, Armin Kraus3, Gerrit Grieb4,5

  • 1Practices for Nuclear Medicine, Rubensstraße 125, 12157 Berlin, Germany.

Summary

Multimodal large language models (MLLMs) show limited accuracy in interpreting electrocardiograms (ECGs), failing to meet clinical reliability standards for cardiovascular diagnostics. Further research is needed to improve AI performance and ensure trustworthy results.

Related Concept Videos