对ChatGPT在皮肤病专业级 (董事会式) 认证问题上的表现的元分析 摘要
1The School of Medicine, The University of Auckland, New Zealand.
Indian dermatology online journal
|July 25, 2025
概括
这一元分析显示,ChatGPT在皮肤病学委员会式问题上获得了69.97%的准确性,GPT-4.0的表现优于GPT-3.5.5. 它建议ChatGPT作为皮肤病学认证准备的有价值的教育工具.
科学领域:
- 人工智能在医学中的应用
- 医疗教育 技术 技术 医学教育
- 皮肤病学专业培训 皮肤病学专业培训
背景情况:
- 人工智能 (AI) 聊天机器人,如ChatGPT,在医疗应用中展示了潜力.
- 皮肤病学是一个正在探索人工智能工具用于教育支持的领域.
研究的目的:
- 评估ChatGPT在皮肤病专业认证 (板式) 问题上的表现.
- 综合来自多项关于ChatGPT在这个领域的准确性研究的证据.
主要方法:
- 一个系统的元分析搜索了PubMed/MEDLINE和EMBASE到2024年12月10日.
- 一个随机效应模型评估了整体ChatGPT性能,并对GPT-3.5和GPT-4.0.0进行了子组分析.
- 使用I2统计学来评估异质性.
主要成果:
- 包括13项研究,对ChatGPT的整体聚合精度为69.97%.
- 与ChatGPT-3.5 (61.07%) 相比,ChatGPT-4.0获得了更高的准确性 (79.46%).
- 在研究中观察到显著的异质性 (I2 = 93.28%).
结论:
- 聊天GPT显示了作为皮肤病学董事会认证候选人的补充教育资源的潜力.
- 限制包括英语语言重点和考试特定的表现,限制对临床实践的概括性.
- 需要进一步的研究来探索异质性因素,如问题难度和皮肤病学子域.


