对人类生成与人工智能起草的医学学生绩效评估总结段落进行比较分析
Atul Maheshwari1,2,3, Arindam Sarkar3,4, Sanghamitra M Misra5,6
1Department of Neurology, Baylor College of Medicine, Houston, TX, USA.
Medical teacher
|October 18, 2025
概括
生成型人工智能 (GenAI) 可以有效地起草医学学生绩效评估 (MSPE) 摘要段落. 这些人工智能生成的文本在质量上与人类撰写的文本相提并论,并可能减少偏见.
科学领域:
- 医学教育 医学教育
- 医疗保健中的人工智能
背景情况:
- 创建医学学生绩效评估 (MSPE) 是医学教育中一个关键但耗时的过程.
- 生成型人工智能 (GenAI) 为简化医疗保健和教育领域的行政任务提供了潜在的解决方案.
研究的目的:
- 评估使用GenAI,特别是微软365Copilot的效率和有效性,以起草MSPE摘要段落.
- 为了比较GenAI起草的MSPE段落与人类生成的段落的完成时间和质量.
主要方法:
- MSPE总结段落是使用微软365Copilot编写的,基于儿科医生职位评估.
- 记录了GenAI起草和人类生成段落的完成时间.
- 本科医学教育 (UME) 领导人参加了一项盲目的调查,以评估随机选择的段落对.
主要成果:
- 副驾驶员起草的段落比人类生成的段落要快得多 (中位数为6分钟与12.5分钟).
- UME领导人无法在人工智能和人类作者之间进行一致的区分,并没有显示出明显的偏好.
- 人工智能起草的段落被认为具有较少偏见的语言,这得到了UME领导人和性别偏见计算器的证实.
结论:
- 通过微软365 Copilot,GenAI提供了一种有效的方法来起草MSPE摘要段落.
- 人工智能生成的MSPE摘要的质量与人类撰写的版本相美.
- 在MSPE起草中使用GenAI可能有助于减少评估中的偏见.

