胸部外科咨询中的人工智能:评估大型语言模型与专家临床决策之间的一致性
Carlos Déniz1,2,3,4, Judith Marcè1, Iván Macia1,2,3,4
1Department of Thoracic Surgery, Hospital Universitari de Bellvitge, L'Hospitalet de Llobregat, Barcelona, Spain.
Frontiers in digital health
|December 3, 2025
概括
人工智能与胸部外科医生的决定达成适度一致,特别是在瘤病例中. 人工智能显示出有助于门诊工作流程的潜力,但应该补充,而不是取代专家临床判断.
科学领域:
- 医疗信息学 医疗信息学
- 人工智能在医学中的应用
- 胸部外科手术 胸部外科手术
背景情况:
- 人工智能 (AI) 和大型语言模型 (LLM) 在临床环境中的整合正在增长.
- 然而,它们在胸部手术决策中的具体应用需要进一步研究.
研究的目的:
- 评估人工智能产生的建议 (Scholar GPT) 与经过董事会认证的胸部外科医生做出的决定之间的一致性.
- 评估AI在胸部外科外科诊所的潜在实用性.
主要方法:
- 一项回顾性观察性研究分析了81次胸部外科门诊诊疗程.
- 学者GPT的诊断和治疗建议与外科医生的决定进行了比较,使用6分一致度表.
- 统计分析包括描述性统计,t测试/ANOVA和千平方测试.
主要成果:
- 学者GPT和外科医生之间的平均一致性得分为3.67±1.17.
- 在56.8%的病例中观察到高一致性 (得分为4-5),特别是对于瘤诊断,如中瘤和多瘤.
- 在复杂的病例中,如转移性肺病和胸部出口综合征,注意到较低的一致性.
结论:
- 学者GPT在结构化瘤病例中与外科医生的决定保持一致方面表现出前景,但在复杂的场景中表现出变化.
- 人工智能工具可能有助于简化门诊工作流程,但应作为对专家临床判断的补充而不是替代.
- 这些发现是探索性的,由于研究的小样本规模和单中心,短时间的设计,因此需要谨慎.


