评估ChatGPT在骨科培训考试方面的能力:对新的图像处理功能进行分析
Kevin M Posner1, Cassandra Bakus1, Grace Basralian1
1Department of Orthopedic Surgery, Hackensack Meridian School of Medicine, Nutley, USA.
Cureus
|April 11, 2024
概括
人工智能 (AI) 在回答骨科手术考试问题时表现出有限的准确性,即使使用图像分析. 需要进一步的研究来确定人工智能在补充外科医生的技能方面的作用.
科学领域:
- 医疗人工智能的人工智能
- 整形外科教育 整形外科教育
背景情况:
- 人工智能 (AI) 融入骨科手术等医疗专业正在迅速发展.
- 聊天GPT的图像分析能力为医学教育和评估提供了一个新的探索领域.
研究的目的:
- 评估ChatGPT (3.5和4.0版本) 在回答骨科培训内检查 (OITE) 问题上的表现.
- 评估ChatGPT的答案的准确性,特别是对于需要图像分析的问题.
主要方法:
- 选择了AAOS OITE多年来的问题.
- 使用ChatGPT 3.5和4.0来回答非图像问题;仅使用ChatGPT 4.0来回答图像问题.
- 人工智能生成的答案与正确答案进行了比较,以确定准确度.
主要成果:
- 与基于图像的问题相比,ChatGPT 4.0在非基于图像的问题上显示了显著更高的准确性 (67.81%) 与基于图像的问题相比 (47.59%).
- 该研究分析了940个OITE问题,包括457个基于图像和483个非基于图像的问题.
结论:
- 尽管人工智能取得了进展,但ChatGPT目前在骨科知识评估中的准确性,即使是图像分析,也是不够的.
- 持续的研究至关重要,以了解人工智能如何有效地增强,而不是取代骨科外科医生的专业知识.
更多相关视频
07:44Evaluation of Patients' Posture and Gait Profile After Lumbar Fusion Surgery by Video Rasterstereography and Treadmill Gait Analysis
Published on: March 23, 2019
17.8K
06:28Biomechanical Changes Related to Low Back Pain: An Innovative Tool for Movement Pattern Assessment and Treatment Evaluation in Rehabilitation
Published on: December 13, 2024
487
