评估多式联机ChatGPT用于眼部创伤病例的紧急决策
Jiezheng Xue1, Zhouqian Wang1, Nuo Chen1
1Ningbo Key Laboratory of Medical Research on Blinding Eye Diseases, Ningbo Eye Institute, Ningbo Eye Hospital, Wenzhou Medical University, Ningbo, China.
Frontiers in cell and developmental biology
|April 11, 2025
概括
在诊断眼部创伤和指导急诊医生手术决策方面,ChatGPT显示出前景. 然而,它在解释临床图像方面的能力需要进一步增强.
科学领域:
- 眼科医生 眼科 眼科
- 人工智能的人工智能
- 医学诊断 医学诊断 医学诊断
背景情况:
- 在紧急情况下,对眼部创伤的诊断对及时和准确的评估提出了挑战.
- 整合人工智能 (AI) 工具,如ChatGPT,为提高诊断效率提供了潜在的解决方案.
研究的目的:
- 在眼部创伤病例中评估ChatGPT (GPT-3.5轮和GPT-4.0轮) 的诊断准确性.
- 评估ChatGPT在眼睛创伤中确定手术干预的必要性的能力.
- 调查多式输入 (文本和图像) 对ChatGPT性能的影响.
主要方法:
- 这是一项对宁波眼科医院52例眼部创伤病例的回顾性观察研究.
- 输入案例详细信息到GPT-3.5轮机和GPT-4.0轮机中. 在中文和英语两种语言.
- 结合眼睛表面的照片来评估ChatGPT的多式联络性能.
- 六位高级眼科医生对GPT-4.0轮生成的图像描述进行了专家评估.
主要成果:
- 只有文本输入的诊断准确率为80.77%-88.46% (GPT-3.5轮机) 和94.23%-98.08% (GPT-4.0轮机).
- 在结合摄影数据时,GPT-4.0轮机的精度降至63.46%.
- 图像理解评估的完整度得分为3.59 ± 0.94到3.69 ± 0.90和正确度得分为3.21 ± 1.04到3.38 ± 1.00.
结论:
- 聊天GPT展示了作为一个工具,以帮助急诊医生在适当和及时的评估和眼睛创伤患者的分类的潜力.
- 需要进一步改进ChatGPT的临床图像理解能力,以进行全面的眼部创伤管理.


