相关实验视频
Updated: Jul 26, 2025

07:36
Mechanical Ventilation Boot Camp Curriculum
Published on: March 12, 2018
10.3K
医学院的ChatGPT:人工智能在进度测试中有多成功?
Hendrik Friederichs1, Wolf Jonas Friederichs2, Maren März3
1Medical School OWL, Bielefeld University, Bielefeld, Germany.
Medical education online
|June 12, 2023
概括
像ChatGPT这样的生成人工智能 (AI) 可以以65.5%的准确度回答医学问题,与医学学生在研究的后期相比. 这种人工智能工具在医学知识评估方面展示了潜力.
科学领域:
- 医学教育 医学教育
- 人工智能在医学中的应用
背景情况:
- 生成型人工智能 (AI) 提供了广泛的信息访问,包括医学知识.
- 医学院优先考虑教学和评估医疗知识的医生表现.
- 评估AI的医学知识准确性对于其融入教育至关重要.
研究的目的:
- 通过将其性能与医学学生进行比较来评估ChatGPT的实际知识.
- 测量ChatGPT对医学多选题 (MCQ) 的答案的准确性.
主要方法:
- 来自进度测试的400个医学MCQ被输入到ChatGPT.
- 评估了ChatGPT的响应准确度.
- 分析了响应准确度和响应时间,单词数和问题难度之间的相关性.
主要成果:
- 聊天GPT正确回答了65.5%的MCQ.
- 响应准确度与响应时间或单词数没有相关性.
- 在MCQ难度和ChatGPT的响应准确度之间发现了显著的正相关性.
结论:
- 聊天GPT正确地回答了三分之二的医疗许可证考试级别问题.
- 聊天GPT的表现超过了大多数初年医学学生的表现.
- 聊天GPT的知识水平相当于医学学生在研究后半年.

