一项基于对ChatGPT和基于证据的神经外科医生进行比较的描述性研究
Jiayu Liu1, Jiqi Zheng2, Xintian Cai3
1Department of Neurosurgery, the First Medical Centre, Chinese PLA General Hospital, Beijing 100853, China.
iScience
|September 14, 2023
概括
这项研究评估了神经外科手术中的人工智能 (AI) 聊天机器人. GPT-4.0的表现与经验丰富的神经外科医生的表现相当,这表明AI.
科学领域:
- 神经外科 神经外科
- 人工智能的人工智能
- 医疗信息学 医疗信息学
背景情况:
- 人工智能 (AI) 在医疗实践中的整合正在迅速推进.
- 在专业领域评估像ChatGPT这样的AI工具的临床适用性至关重要.
- 基于证据的医学 (EBM) 原则是安全有效的神经外科护理的基础.
研究的目的:
- 评估ChatGPT (GPT-3.5和GPT-4.0) 与神经外科的基于证据的医学的坚持.
- 将ChatGPT的反应与不同级别的神经外科医生的反应进行比较.
主要方法:
- 产生了50个神经外科问题,涵盖了各种神经外科疾病.
- 每个问题都向GPT-3.5和GPT-4.0.0提出三次.
- 响应被三个神经外科医生 (高级,中等和低资历) 评估,并分析了绩效得分.
主要成果:
- GPT-3.5的EBM坚持与初级神经外科医生相当.
- GPT-4.0的EBM坚持与高级神经外科医生相美.
- 分析包括总分,专业分类和问题类型.
结论:
- 聊天GPT,特别是GPT-4.0,在提供与EBM一致的神经外科信息方面显示出显著的潜力.
- 虽然还没有超过经验丰富的神经外科医生,但人工智能的能力正在进步.
- 未来的AI代可能会进一步提高其在神经外科决策支持中的实用性.


