医生,实习生,还是GPT? 对人工智能增强的操作笔记进行盲目的多中心研究
Sholem Hack1, Rebecca Attal1, Giacomo Locatelli2
1City St. George's University of London, School of Medicine, Program Delivered by University of Nicosia at the Chaim Sheba Medical Center, Ramat Gan, Israel.
The Laryngoscope
|August 20, 2025
概括
通过使用像GPT这样的人工智能写作助手, 手术医生可以提高手术笔记的质量和效率. 人类与人工智能的协作提高了准确性和一致性,优于人工智能或仅人类使用的方法.
科学领域:
- 医疗信息学
- 手术文档
- 医疗保健中的人工智能
背景情况:
- 清晰的手术文件对于手术安全,患者护理连续性和医疗法律合规性至关重要.
- 大型语言模型 (LLM) 显示了自动化临床文档的潜力,但它们在生成手术笔记方面的有效性,特别是在外科子专业领域,需要进一步研究.
研究的目的:
- 通过手术实习生,主治外科医生,单独使用GPT,以及使用GPT辅助的主治外科医生生成的手术笔记的质量,准确性和效率进行比较.
- 评估人类与人工智能合作对外科文档完整性和正确性的影响.
主要方法:
- 选择了五种耳鼻喉手术进行分析.
- 操作笔记是由一个居民,一个参与者,GPT单独,和一个混合的参与者加GPT.
- 十位盲人耳鼻喉科医生 (住院医生和护理人员) 审查了这些笔记,在八个领域中给出了评分,并提供了认可评分. 记录了记录时间.
主要成果:
- 由主治外科医生和GPT共同撰写的操作笔记获得了最高的领域分数和79%的"现状"批准率,超过了所有其他方法.
- 只有GPT笔记的生成速度最快,但认可率最低 (23%) 和错误最多 (遗漏和过度文档).
- 人工智能辅助的文档与仅由人类撰写的文档相比,显著减少了写作时间,观察到中等到高的互评级可靠性.
结论:
- 与本研究中仅使用人类或人工智能方法相比,混合人类-人工智能合作在操作文档中产生了更好的结果.
- 在手术实践中,GPT辅助的文档有望提高手术笔记生成的效率和一致性.


