评估ChatGPT在医学生物化学中的表现,使用临床病例简历:观察性研究
1Panimalar Medical College Hospital & Research Institute, Chennai, India.
JMIR medical education
|November 7, 2023
概括
聊天GPT在医学生物化学案例小组中表现出不一致的准确性,在第二次尝试中得分为60%的正确答案. 在将AI整合到医学教育中之前,需要进一步验证.
科学领域:
- 医疗教育中的人工智能
- 生物化学教育教育 生物化学教育
- 自然语言处理自然语言处理.
背景情况:
- 在信息生成和检索方面,ChatGPT显示出高性能.
- 聊天GPT已经成功通过了美国医学执照考试 (USMLE).
- 聊天GPT在医学教育中的潜力是一个重要的全球讨论.
研究的目的:
- 评估ChatGPT在医学生物化学中的性能.
- 通过使用临床病例图片来评估ChatGPT的准确性.
主要方法:
- 在医学生物化学中使用了10个随机选择的临床病例 vignettes.
- 案例简介和响应选项被输入到ChatGPT.
- 答案进行了两次测试,并与参考材料进行了验证.
主要成果:
- 在第一次尝试时,ChatGPT在10个案例中为4个提供了正确的答案.
- 在第二次尝试中,ChatGPT在10个案例中正确回答了6个.
- 案例3在多次尝试中产生了不同的答案,可能是由于氨基酸代谢的复杂性.
结论:
- 聊天GPT可能不是医学教育学习和评估的可靠来源.
- 该研究的局限性包括样本规模小,使用ChatGPT版本3.5.5.
- 在实际实施之前,医学教育中的AI需要严格验证准确性和可靠性.


