评估人工智能对胸部外科手术产生的答案的准确性和患者感知
Esra Yamansavcı Sirzai1, Celal Bugra Sezen2, Gizem Ozcibik Isik3
1Department of Thoracic Surgery, Suat Seren Chest Diseases and Thoracic Surgery Education and Research Hospital, Izmir, Turkey.
Journal of cardiothoracic surgery
|November 26, 2025
概括
像ChatGPT-4o和Gemini 1.5这样的AI聊天机器人提供了关于胸部手术的高质量信息. 专家外科医生发现他们的反应没有显著差异,但患者与医疗专业人员的咨询仍然至关重要.
科学领域:
- 医疗信息学 医疗信息学
- 医疗保健中的人工智能
- 胸部外科手术 胸部外科手术
背景情况:
- 胸部形是一种常见的疾病,需要手术干预.
- 患者经常通过在线道寻求关于胸部手术的信息.
- 人工智能对患者查询的响应质量是一个新兴的研究领域.
研究的目的:
- 评估和比较来自ChatGPT-4o和双子座1.5的响应质量,以回答有关乳房形的患者常见问题.
- 评估人工智能产生的关于胸部手术的相关性,准确性,清晰性和完整性.
主要方法:
- 进行了一项横截面调查研究.
- 36个关于胸部手术的常见问题被提出给ChatGPT-4o和双子座1.5.5.
- 十位专业的乳房外科医生使用标准化尺度对AI反应进行了评分,通过类内相关系数 (ICC) 评估了interrater可靠性.
主要成果:
- 聊天GPT-4o和双子座1.5都在相关性,准确性和清晰度标准上显示出高平均分数.
- 在ChatGPT-4o和Gemini 1.5.5之间的响应质量方面,没有发现统计学上显著的差异.
- 评价者之间的可靠性分析也显示没有显著差异,这表明专家小组的评估是一致的.
结论:
- 人工智能应用显示出有关胸部手术的患者教育的巨大潜力.
- 人工智能产生的反应不能代替专业的医疗建议.
- 建议患者咨询医疗保健专家,以验证从AI系统中获得的信息.


