评估大型语言模型与人类研究人员在现实世界复杂的医学查询中的表现

Daphna Idan1, Itamar Ben-Shitrit2,3, Mark Volevich4

  • 1Ben-Gurion Faculty of Health Sciences, Beer-Sheva, Israel. daphnaid@post.bgu.ac.il.

Scientific reports
|October 30, 2025
PubMed
概括

大型语言模型 (LLM) 在生成可靠的临床报告方面还不能与人类研究人员相匹配. 医生满意度是报告质量的不可靠指标,突出了LLM能力的重大差距.

相关概念视频