聊天GPT-4表现在鼻科:一个临床病例系列
Thomas Radulesco1,2, Alberto Maria Saibene1,3, Justin Michel2
1Research Committee of Young Otolaryngologists of the International Federation of Otorhinolaryngological Societies, Paris, France.
International forum of allergy & rhinology
|January 25, 2024
概括
与鼻科病例的从业者相比,生成预训练变压器 (ChatGPT) -4建议进行两倍以上的检查. 虽然诊断准确度是中等的,但ChatGPT-4的诊断准确度是中等的.
科学领域:
- 耳鼻喉科 耳鼻喉科 耳鼻喉科
- 人工智能在医学中的应用
- 临床决策支持 临床决策支持
背景情况:
- 人工智能 (AI) 融入临床实践为医学诊断和管理提供了潜在的好处.
- 像ChatGPT-4这样的大型语言模型越来越多地被探索在医疗保健环境中的实用性.
- 鼻科提供复杂的临床病例,诊断准确性和适当的管理是至关重要的.
研究的目的:
- 评估ChatGPT-4在鼻科的临床病例管理中的性能.
- 将ChatGPT-4的诊断和管理建议与人类从业者进行比较.
- 评估ChatGPT-4提出的诊断,检查和治疗方案的一致性和准确性.
主要方法:
- 用临床病例进行了鼻科的比较分析.
- 记录了ChatGPT-4对诊断,额外检查和治疗的建议.
- 这些建议与人类从业人员提供的建议进行了比较.
- 分析了ChatGPT-4响应的稳定性和准确性,涉及不同的案例难度.
主要成果:
- 与实践者相比,ChatGPT-4推的额外检查数量是实践者的两倍多.
- 通过ChatGPT-4提出的初级诊断在62.5%的病例中是可信和正确的.
- 用ChatGPT-4进行必要的额外检查和治疗方案的指示分别在7.5%至30.0%和7.5%至32.5%之间.
- 报告的临床病例难度没有显著影响ChatGPT-4的性能.
结论:
- 与临床医生相比,ChatGPT-4显示出一种倾向,表明鼻科的检查量较高.
- 虽然能够进行合理的初级诊断,但ChatGPT-4对进一步调查和治疗的建议显示出相当大的变化.
- 人工智能的响应稳定性中等至高,表明可靠的临床支持的潜力,尽管需要进一步改进以获得最佳的管理指导.


