相关实验视频
Updated: Jan 7, 2026

05:15
Grossing of Non-neoplastic Globes, Including Fetal Eyes
Published on: May 30, 2025
454
聊天GPT在专家法医病理学检查上的表现:对法医病理学家和非专家的影响
Hans H de Boer1,2, Gregory Young3,4, Heinrich Bouwer3,4
1Department of Forensic Medicine, Monash University, 65 Kavanagh Street, Southbank, VIC, 3006, Australia. hans.de.boer@vifm.org.
International journal of legal medicine
|December 28, 2025
概括
像ChatGPT这样的人工智能语言模型 (LLM) 擅长回忆法医病理事实,但难以复杂的推理和图像解释. 他们的自信但不准确的输出需要专家审查,以确保安全的医疗应用.
科学领域:
- 医疗信息学 医疗信息学
- 法医病理学 法医病理学
- 人工智能的人工智能
背景情况:
- 人工智能语言模型 (LLM) 在医学中的越来越多的使用引发了对准确性,推理和安全性的担忧.
- 法医病理学要求平衡的推理,情境敏感性和精确的沟通,使得法学士评估至关重要.
研究的目的:
- 评估ChatGPT在法医病理学中的能力和局限性.
- 了解医学应用中LLM使用的更广泛的风险和好处.
主要方法:
- 聊天GPT-4.5 Turbo使用澳大利亚皇家病理学家学院的模拟法医病理学奖学金考试进行了评估.
- 考试包括作文问题,基于图像的任务和案例报告.
- 经验丰富的检查员基于准确性,推理和沟通,盲目标记了答案.
主要成果:
- 在基于知识的作文问题上,ChatGPT的表现很好,但在需要复杂推理或图像解释的任务上表现不佳.
- 该模型产生了流和有说服力的输出,经常产生错误的准确性印象.
- 事实准确性不一致,特别是在上下文依赖的分析中.
结论:
- 聊天GPT可以复制已建立的法医病理学知识,但缺乏更高层次的推理能力.
- 误导性自信的输出构成风险,尤其对非专家来说.
- 法医病理学LLM的使用需要仔细的专家监督,只适用于低风险的行政或教育任务.

