在腹部手术中评估人工智能能力:对ChatGPT-4和DALL·E 3的识别和插图准确性的研究
Mohammad Mahjoubi1, Shahab Shahabi1, Saba Sheikhbahaei2
1Minimally Invasive Surgery Research Center, Iran University of Medical Sciences, Tehran, Iran.
Obesity surgery
|December 29, 2024
概括
像ChatGPT-4和DALL·E 3这样的人工智能 (AI) 工具在识别和生成减肥手术插图方面存在局限性,这表明需要在医学教育中进一步开发AI.
科学领域:
- 医学教育 医学教育
- 在外科手术中使用人工智能
- 外科手术的插图.
背景情况:
- 人工智能 (AI) 为增强医学教育材料提供了新兴机会.
- 像OpenAI的ChatGPT-4和DALL·E 3这样的工具正在探索它们在外科训练中的潜力.
- 这项研究调查了人工智能在减肥手术教育中的当前能力.
研究的目的:
- 评估ChatGPT-4o在从视觉插图中识别减肥外科手术程序的准确性.
- 评估DALL·E 3在生成精确的医学插图上的有效性,减肥手术程序.
主要方法:
- 从IFSO代谢和减肥外科手术图谱中选择了六种减肥手术.
- 聊天GPT-4被用来分类这些程序的插图.
- DALL·E 3 被提示为每个命名的程序生成插图.
主要成果:
- 聊天GPT-4正确地识别了只有一个程序 (可调节的胃带),错误地分类了其他五个程序.
- DALL·E 3未能为任何六种肥胖症手术生成准确的插图.
- 这两种人工智能工具在这个特定应用中都显示出了显著的局限性.
结论:
- 目前的人工智能模型,包括ChatGPT-4和DALL·E3,在减肥外科教育中使用有很大的局限性.
- 进一步的研究和开发对于提高AI在创建和解释外科视觉图像的准确性和可靠性至关重要.
- 这些发现强调了在将这些人工智能工具整合到医疗培训计划之前需要谨慎和持续评估.


