分析ChatGPT-4在MIR考试中的眼科问题上的表现
C E Monera Lucas1, C Mora Caballero2, J Escolano Serrano3
1Servicio de Oftalmología, Hospital General Universitario de Elche, Elche, Alicante, Spain; Universidad Miguel Hernández de Elche, Elche, Alicante, Spain; Centro Oftalmológico de Elche, Elche, Alicante, Spain.
Archivos de la Sociedad Espanola de Oftalmologia
|May 11, 2025
概括
聊天GPT-4在眼科检查中表现出高精度,在临床场景中得分为90.2%. 这种人工智能工具在专业人员使用时,有望帮助医学教育和患者护理.
科学领域:
- 眼科医生 眼科 眼科
- 人工智能在医学中的应用
- 医学教育 医学教育
背景情况:
- 人工智能 (AI) 在医学诊断和教育中的整合正在迅速发展.
- 在眼科等专业医疗领域评估AI性能对于理解其潜在应用至关重要.
- 住院医疗实习生 (MIR) 考试提供了对临床知识的标准化评估.
研究的目的:
- 评估ChatGPT在解决眼科相关临床情景中的有效性.
- 为了比较ChatGPT的表现与眼科专业人员使用MIR考试问题.
主要方法:
- 采用横截面研究设计来评估ChatGPT作为诊断工具.
- 分析了来自MIR考试 (2010-2023) 的眼科问题.
- 计算了ChatGPT的准确性,敏感性,特异性以及与专家评估的一致性.
主要成果:
- 在54个眼科考试问题上,ChatGPT获得了90.2%的总分.
- 观察到高灵敏度 (92.59%) 和特异性 (96.8%).
- 专家评价人的一致性为86.41%,评价者之间的一致性为79.62%.
结论:
- 聊天GPT-4是解决临床场景和眼科理论问题的宝贵工具.
- 像ChatGPT这样的AI工具的监督应用可以增强眼科患者护理流程.
- 人工智能显示出在专业医疗培训和实践中作为支持资源的潜力.


