在眼科中ChatGPT的诊断能力
Asaf Shemer1,2, Michal Cohen3,4, Aya Altarescu3,5
1Department of Ophthalmology, Shamir Medical Center (Formerly Assaf-Harofeh), Tzrifin, Israel. ShemerAsafMD@gmail.com.
概括
与医疗专业人员相比,ChatGPT在眼科领域的诊断准确性较低. 虽然它更快,但它的诊断性能需要改善,以获得临床应用.
科学领域:
- 眼科医生 眼科 眼科
- 人工智能在医学中的应用
- 医学诊断 医学诊断 医学诊断
背景情况:
- 人工智能 (AI) 在医疗保健中的整合为诊断过程提供了潜在的好处.
- 在专业医疗领域,评估像ChatGPT这样的大型语言模型 (LLM) 的诊断能力至关重要.
研究的目的:
- 评估ChatGPT在眼科中的诊断准确性.
- 将ChatGPT的诊断性能与眼科住院医生和护理人员进行比较.
主要方法:
- 一项回顾性队列研究分析了来自63名患者的126例眼科病例.
- 临床病例被介绍给ChatGPT,住院医生和护理人员,仅基于病史 (Hx) 和病史与检查结果 (Hx和Ex).
- 所有组的诊断准确率和任务完成时间都进行了比较.
主要成果:
- 当单独使用Hx时,ChatGPT的诊断准确度明显低于仅使用Hx时的住院人员和护理人员 (54%对比75%和71%).
- 随着Hx和Ex,ChatGPT的准确性提高到68%,仍然低于居民 (94%) 和出席 (86%).
- 聊天GPT在完成诊断任务时比人类临床医生快4-5倍.
结论:
- 与人类专家相比,ChatGPT在眼科中表现出低于最佳的诊断准确性,即使有额外的临床数据.
- 尽管精度较低,但ChatGPT提供了显著的节省时间的好处.
- 需要进一步开发以提高AI诊断能力在专业医疗领域.


