相关实验视频
Updated: Jul 6, 2025

12:08
Improving IV Insulin Administration in a Community Hospital
Published on: June 11, 2012
18.8K
聊天GPT-探索其在临床化学中的作用
Ridwan B Ibrahim1,2, Anil K Chokkalla1,2, Kaitlyn Levett1
1Department of Pathology and Immunology, Baylor College of Medicine, Houston, TX, USA.
Annals of clinical and laboratory science
|January 5, 2024
概括
像ChatGPT 3.5和GPT-4这样的人工智能语言模型在回答临床化学问题时不如临床化学家那么准确. 人类专家对于可靠的实验室测试结果解释至关重要.
科学领域:
- 临床化学 临床化学
- 医疗保健中的人工智能
- 医学诊断 医学诊断 医学诊断
背景情况:
- 人工智能 (AI) 语言模型越来越多地被整合到各种专业领域.
- 像ChatGPT 3.5和GPT-4这样的先进AI模型在专业医疗领域的实用性需要彻底评估.
- 临床化学依赖于对实验室测试的准确解释,以诊断和管理患者.
研究的目的:
- 为了比较人工智能语言模型 (ChatGPT 3.5 和 GPT-4) 与人类专家在回答临床化学问题的准确性.
- 评估AI模型相对于临床化学学员和教师的表现.
- 确定AI在临床化学咨询中的当前能力和局限性.
主要方法:
- 一组35个临床化学问题从现实世界的场景中策划.
- 聊天GPT 3.5,GPT-4,临床化学居民,研究员和教师的任务是回答这些问题.
- 对答案的准确性进行了评估,并根据受访者的经验水平得分.
主要成果:
- 高级临床化学教师的准确率达到100%,超过初级教师 (90.5%),研究员 (82.9%) 和居民 (71.4%).
- 聊天GPT 3.5 (60%) 和GPT-4 (71.4%) 的准确率都低于所有人类参与者组.
- 虽然GPT-4与ChatGPT 3.5相比表现有所改善,但这两种AI模型的表现都明显优于经验丰富的化学家.
结论:
- 目前的AI语言模型,包括ChatGPT 3.5和GPT-4,尚未能够取代训练有素的临床病理学家来回答复杂的临床化学问题.
- 没有临床化学专业培训的用户在使用AI聊天机器人解释实验室结果时应极其谨慎.
- 人类专业知识对于确保临床化学诊断的准确和安全应用至关重要.

