相关实验视频
Updated: Jun 13, 2025

08:06
Mixed Reality Assisted Radical Endoscopic Thyroidectomy
Published on: January 31, 2025
225
在手术中GPT-3.5和GPT-4.0的诊断能力:比较分析
Jiayu Liu1, Xiuting Liang2, Dandong Fang3
1Department of Neurosurgery, The First Medical Centre, Chinese PLA General Hospital, Beijing, China.
Journal of medical Internet research
|September 10, 2024
概括
与GPT-3.5相比,GPT-4.0对结肠癌的诊断准确度更高,显示出作为外科医生的辅助工具的巨大潜力. 需要进一步的研究来解决 GPT-4.0 的问题.
科学领域:
- 人工智能在医学中的应用
- 临床决策支持系统 临床决策支持系统
- 瘤学 诊断 诊断 瘤学
背景情况:
- 聊天GPT显示作为临床诊断辅助的承诺.
- 评估AI诊断能力对于临床整合至关重要.
- 这项研究比较了GPT-3.5和GPT-4.0在诊断中的表现.
研究的目的:
- 评估GPT-3.5和GPT-4.0对结肠癌的诊断准确度.
- 为了比较GPT-3.5与GPT-4.0.0的诊断性能.
- 分析错误诊断的原因,并评估AI作为外科辅助工具.
主要方法:
- 分析了316份肠癌病例报告 (286份有效).
- 病例数据被翻译并输入GPT-3.5和GPT-4.0.0中.
- 高级外科医生评估了初级和二级诊断的准确性.
主要成果:
- 在初级 (0.972对0.855) 和二次 (0.908对0.617) 诊断中,GPT-4.0显著优于GPT-3.5.
- GPT-3.5在患者病史,症状,实验室和成像数据方面遇到了困难.
- GPT-4.0显示在症状和实验室数据解释方面存在局限性.
结论:
- 聊天GPT,特别是GPT-4.0,对结肠癌具有显著的诊断潜力.
- GPT-4.0的准确性超过了GPT-3.5,但局限性仍然存在.
- 现实世界的验证是提高AI诊断能力所必需的.

