评估ChatGPT o1在外围神经外科手术中的能力:在临床实践中推进人工智能
Tim Leypold1, Jörg Bahm1, Justus P Beier1
1Department of Plastic Surgery, Hand Surgery-Burn Center, University Hospital RWTH Aachen, Aachen, Germany.
World neurosurgery
|February 9, 2025
概括
生成型人工智能在协助外围神经外科手术决策方面表现有前途. 虽然在理解病例方面是有效的,但人类的专业知识仍然对改进AI诊断和治疗建议在这个专业领域至关重要.
科学领域:
- 医疗人工智能 医疗人工智能
- 神经外科 神经外科
- 临床决策支持系统 临床决策支持系统
背景情况:
- 人工智能 (AI) 越来越多地被整合到医疗保健中,以改善临床决策和患者管理.
- 外周神经外科手术提出了复杂的挑战,需要精确的诊断和治疗策略.
研究的目的:
- 评估OpenAI生成性AI模型 (o1) 在辅助外围神经外科手术中的复杂决策方面的实用性.
- 在模拟的手术场景中评估AI作为虚拟医疗助理 (生成预训练变压器神经外科 [GPT-NS]) 的表现.
主要方法:
- 使用先进的提示工程来配置GPT-NS,以处理5个模拟的外周神经手术病例.
- 人工智能协助医疗史审查,诊断和治疗计划,生成病例摘要.
- 一个由专家和住院人员组成的小组根据7个标准在利克特级别上评估了GPT-NS的表现.
主要成果:
- GPT-NS获得了4.3的平均绩效评分,在理解临床问题和病例陈述清晰度方面表现出色.
- 需要改进的领域包括诊断序列和治疗建议.
- 人类评估者在案例处理中感觉到自己的优势,尽管GPT-NS显示出作为支持工具的潜力.
结论:
- 大型语言模型人工智能性能正在进步,需要专家评估以确保安全的临床整合.
- 人工智能在外围神经外科手术等专业领域增加临床决策的巨大潜力.
- 需要进一步的研究来完善人工智能能力,并将其整合到外科手术工作流程中.


