儿科皮肤科医生与人工智能机器人:评估ChatGPT的医学知识和诊断能力
Charles Y Huang1, Esther Zhang2, Marie-Chantal Caussade3
1Sidney Kimmel Medical College, Philadelphia, Pennsylvania, USA.
Pediatric dermatology
|May 9, 2024
概括
这项研究评估了人工智能 (AI) 工具ChatGPT在儿科皮肤病学中的准确性,与人类专家对比. 虽然人工智能显示出潜力,但临床医生在儿童皮肤疾病的诊断准确度方面仍然优越.
科学领域:
- 儿科皮肤病学 儿科皮肤病学
- 医疗人工智能 医疗人工智能
背景情况:
- 人工智能 (AI) 工具越来越多地被用于临床应用.
- 在儿童皮肤病学等专业医疗领域评估AI的诊断准确性至关重要.
研究的目的:
- 将OpenAI的ChatGPT (3.5和4.0版本) 的临床准确性与儿科皮肤科医生的临床准确性进行比较.
- 在标准化儿科皮肤病学评估中评估AI性能.
主要方法:
- 使用多选项和基于案例的问题评估了ChatGPT版本3.5和4.0.
- 问题来源于美国皮肤病学委员会和儿科皮肤病学"Photoquiz".
- 人工智能反应与经验丰富的儿科皮肤病临床医生的反应进行了比较.
主要成果:
- 人类儿科皮肤病临床医生通常比两个ChatGPT版本都取得了更高的准确性.
- 在评估的某些方面,ChatGPT-4.0的表现与临床医生相美.
- 在各种问题类型和复杂程度上观察到精度的差异.
结论:
- 虽然像ChatGPT这样的AI工具在支持儿科皮肤病学中的临床知识和决策方面表现有前途,但它们尚未与专家临床医生的表现相匹配.
- 人工智能在医学中需要持续开发和严格验证.
- 在将AI整合到患者护理途径中时,临床医生监督仍然至关重要.


