评估ChatGPT 3.5和4.0在StatPearls眼镜整形外科的性能 基于文本和图像的考试问题

Gurnoor S Gill1, Jacob Blair2, Steven Litinsky3

  • 1Medical School, Florida Atlantic University Charles E. Schmidt College of Medicine, Boca Raton, USA.

Cureus
|December 18, 2024
PubMed
概括

与以前的版本相比,ChatGPT-4.0在眼膜问题上表现出更好的准确性. 然而,它在以图像为基础的问题上的表现落后于仅以文本为基础的问题,凸显了在医学教育中需要进一步的LLM进步的需要.