聊天GPT与临床医生:挑战皮肤病学中人工智能的诊断能力
Sophie Stoneham1, Amy Livesey2, Hywel Cooper2
1Department of Dermatology, Royal South Hants Hospital, University Hospitals Southampton, Southampton, UK.
Clinical and experimental dermatology
|November 18, 2023
概括
与皮肤科医生相比,ChatGPT在皮肤病例中表现出诊断能力,但并没有显著提高诊断准确度. 它目前的形式并不是对初级或二级护理诊断的实质性帮助.
科学领域:
- 人工智能在医学中的应用
- 医学诊断 医学诊断 医学诊断
- 自然语言处理自然语言处理.
背景情况:
- 聊天GPT是一个先进的语言模型,利用深度学习来实现类似人类的响应.
- 它在医学诊断中的潜在应用是一个新兴的研究领域.
研究的目的:
- 在现实皮肤病例中评估ChatGPT的诊断准确性.
- 将ChatGPT的诊断性能与人类专家进行比较.
主要方法:
- 来自36名皮肤病患者的匿名临床数据被输入到ChatGPT 4.0.0.
- 将ChatGPT的诊断与皮肤科医生和非专家的诊断进行了比较.
- 诊断准确性是根据初级诊断和提供的差异诊断来评估的.
主要成果:
- 通过皮肤科医生提供的数据,ChatGPT实现了56%的正确初级诊断率,而非专家数据为39%.
- 它的准确性低于皮肤科医生 (83%),但与非专家 (36%) 相当.
- 在100%的病例中,ChatGPT提供了差异诊断,而不是参考来源 (72%).
结论:
- 聊天GPT在皮肤病学中表现出诊断潜力,但目前没有提高诊断产量.
- 需要进一步开发ChatGPT,以显著影响临床诊断的准确性.
- 人工智能提供了谨慎,合理的反应,提供了有价值的差异诊断.


