评估ChatGPT在甲状腺眼病患者咨询和基于图像的初步诊断中的性能
Yue Wang1, Shuo Yang1, Chengcheng Zeng1
1Department of Ophthalmology, Changzheng Hospital of Naval Medical University, Shanghai, China.
Frontiers in medicine
|March 5, 2025
概括
与ChatGPT-4和人类专家相比,ChatGPT-4o在甲状腺眼病 (TED) 咨询和图像解释方面表现优越. 这种先进的AI显示了改善眼科临床效率的潜力.
科学领域:
- 眼科医生 眼科 眼科
- 人工智能的人工智能
- 医疗信息学 医疗信息学
背景情况:
- 大型语言模型 (LLM) 聊天机器人为推进医疗保健提供了巨大的潜力.
- 在线咨询,准确的预诊断和临床决策对于以患者为中心的护理至关重要.
研究的目的:
- 评估ChatGPT在眼科调查中的表现,特别是甲状腺眼病 (TED) 咨询和基于图像的诊断.
- 为了比较ChatGPT-4和ChatGPT-4o与经验丰富的眼科医生的疗效.
主要方法:
- 一项涉及临床调查和16名TED患者的图像数据 (面部和CT扫描) 的横截面研究.
- 聊天GPT-4,聊天GPT-4o和一个眼科教授回应了询问;患者和眼科医生对准确性,全面性,简洁性和满意度进行了评估.
主要成果:
- 聊天GPT-4o提供了更准确和逻辑一致的TED咨询响应,在评估方面表现优于聊天GPT-4和教授.
- 聊天GPT-4o在准确性,全面性,简洁性和满意度方面获得了更高的评分.
- 在基于图像的诊断中,ChatGPT-4o准确地识别了31.25%的面部图像病例中的疾病,并且与CT图像的教授进行了可比性 (87.5%的准确性).
结论:
- 聊天GPT-4o在增强患者咨询和解释眼科图像方面表现有前途,可能提高临床效率.
- 在临床广泛采用之前,需要进一步的研究来解决有关错误信息和法律方面的局限性.


