睡眠医学中的人工智能:评估ChatGPT-4的诊断精度
1Division of Pulmonary, Allergy and Sleep Medicine, Mayo Clinic, Jacksonville, Florida.
概括
聊天GPT-4显示出诊断睡眠障碍的潜力,在最终诊断中达到78.95%的准确性. 虽然有希望,但它的性能因病例复杂性而异,需要进一步的临床验证.
科学领域:
- 睡眠医学 睡眠医学
- 人工智能的人工智能
- 医学诊断 医学诊断 医学诊断
背景情况:
- 大型语言模型 (LLM) 在医学中越来越多地使用.
- 人工智能 (AI) 在睡眠医学中的应用分析数据并预测结果.
- 基于临床病史的睡眠障碍LLM的诊断准确性尚未研究.
研究的目的:
- 为了评估ChatGPT-4的诊断性能.
- 评估ChatGPT-4在诊断睡眠障碍方面的准确性.
主要方法:
- 从睡眠医学案例书中使用了19个临床图片.
- 聊天GPT-4提供了差异和最终诊断.
- 准确度是通过正确差异的百分比和最终诊断的三级评分系统来衡量.
主要成果:
- 不同诊断的平均准确率为63.27%.
- 聊天GPT-4在最终诊断方面实现了78.95%的整体准确性.
- 在68.42%的病例中,最终诊断完全匹配,复杂病例的表现下降.
结论:
- 在睡眠医学中,ChatGPT-4显示出有前途的诊断能力.
- 该模型在差异诊断和最终诊断方面表现出中等到高的准确性.
- 复杂病例中的可变性需要进一步细化和临床验证.


