通过大型语言模型提高声学家检查性能:对ChatGPT-4和Claude 3的分析研究
Xuefeng Li1, Ziman Chen2, Ting Xie1
1Department of Ultrasound, The Fifth Affiliated Hospital of Sun Yat-sen University, Zhuhai.
Medical ultrasonography
|May 11, 2025
概括
像ChatGPT-4和Claude 3这样的大型语言模型可以提高超声波学家的检查性能. 这两种人工智能工具都显著提高了分数,特别是在初级声学家的基础知识方面.
科学领域:
- 医学教育 医学教育
- 医疗保健中的人工智能
- 超声波学 超声波学 超声波学 超声波学
背景情况:
- 超声波医生需要不断的学习和评估.
- 大型语言模型 (LLM) 为教育支持提供了潜在的工具.
- 在医学培训中评估LLM的有效性至关重要.
研究的目的:
- 评估ChatGPT-4和Claude 3对超声波学家准确度的影响.
- 为了比较两个领先的LLM在提高考试答案方面的有效性.
主要方法:
- 一位高级和初级超声波专家完成了实践考试.
- 审查了来自ChatGPT-4和Claude 3的回复和解释.
- 分析了LLM整合前和后的分数.
主要成果:
- 这两种LLM都显著提高了声学家的整体考试成绩.
- 聊天GPT-4和克劳德3显著提高了初级声学家的基本知识分数.
- 聊天GPT-4响应提高了专业知识分数;解释显示了高级声学家的改善.
结论:
- 聊天GPT-4和Claude 3在提高超声波医生检查性能方面具有显著价值.
- 在医学超声波培训中,LLM在加强基础知识方面特别有前途.


