Evaluating Bard Gemini Pro and GPT-4 Vision Against Student Performance in Medical Visual Question Answering:

Jonas Roos1, Ron Martin2, Robert Kaczmarczyk3

  • 1Department of Orthopedics and Trauma Surgery, University Hospital of Bonn, Venusberg-Campus 1, 53127, Bonn, Germany, 49 228-287-14170.

JMIR Formative Research
|December 23, 2024
PubMed
Summary

Large language models (LLMs) show promise in medical image diagnostics, with GPT-4 Vision outperforming Bard Gemini. However, neither AI model matched student performance, highlighting areas for improvement in medical AI development.