人工智能大型语言模型在代谢和减肥手术中的专注实践指标上得分很高
A Sanders1,2, R Lim3, D Jones4
1Department of Surgery, Beth Israel Deaconess Medical Center, Boston, MA, USA.
Surgical endoscopy
|September 24, 2024
概括
聊天GPT-4在代谢和减肥手术 (MBS) 板式问题上表现出强的表现,在没有事先培训的情况下获得高分. 这表明人工智能.
科学领域:
- 医学教育 医学教育
- 在外科手术中使用人工智能
- 进行外科手术培训.
背景情况:
- 人工智能 (AI) 模型,包括ChatGPT,在医学和外科检查中表现有前途.
- 人工智能在代谢和腹部外科 (MBS) 等专业考试中的表现仍然在很大程度上未被评估.
研究的目的:
- 为了评估ChatGPT在板式问题上的有效性,用于代谢和腹手术 (FPD-MBS) 中的集中实践指标.
主要方法:
- 在没有先前人工智能培训的情况下,ChatGPT-4在一个全面的FPD-MBS实践问题库上进行了测试.
- 分析了整体和五个美国外科委员会 (ABS) 类别的表现.
- 单向ANOVA评估了类别之间的正确答案频率差异.
主要成果:
- 聊天GPT-4正确回答了74.1% (189/255) 的问题.
- 在五个ABS类别中没有观察到正确答案率的显著差异 (p=0.22).
- 问题输入格式 (个人与团体) 没有影响准确度.
结论:
- 在没有具体的预训练的情况下,ChatGPT-4在FPD-MBS考试式问题上表现出很高的表现.
- 人工智能工具在MBS教育和评估中显示出作为补充资源的潜力.


