交谈式AI"ChatGPT"在生理学大学考试中表现优于医学学生
Christophe O Soulage1, Fabien Van Coppenolle1, Fitsum Guebre-Egziabher1,2
1CarMeN, INSERM U1060, INRAe U1397, Université Claude Bernard Lyon 1, Bron, France.
Advances in physiology education
|July 11, 2024
概括
与学生相比,像ChatGPT这样的人工智能 (AI) 工具在医学生理学考试中表现优越. 教师必须调整评估以防止人工智能辅助作弊,并评估批判性思维能力.
科学领域:
- 医学教育 医学教育
- 人工智能的人工智能
- 学术诚信 学术诚信
背景情况:
- 交谈性AI的公开发布,如ChatGPT,在学术界中引发了有关潜在滥用的重大担忧.
- 人工智能工具对传统的评估方法提出了挑战,特别是在高等教育中.
研究的目的:
- 量化评估ChatGPT在医学生理学大学考试中的表现.
- 将人工智能生成的答案与医学学生的答案进行比较.
主要方法:
- 聊天GPT被用来回答医学生理学大学考试中的问题.
- 人工智能的表现得到了定量评估,并与24名学生的结果进行了比较.
主要成果:
- 与学生 (56%) 相比,ChatGPT的中位数得分明显高 (75%).
- 聊天GPT的合格率为100%,而29%的学生没有通过考试.
- 人工智能的表现明显超过了学生的表现 (P < 0.001).
结论:
- 聊天GPT的功能可能会在学生中促进抄袭和智力惰的风险.
- 教育机构必须制定评估方法,以评估学生的真实反思,并减轻人工智能辅助作弊.
- 人工智能的广泛使用需要重新评估学术评估策略.


