: (TMS)

Henrik Stelling1, Armin Kraus2, Gerrit Grieb3,4

  • 1Practices for Nuclear Medicine, Rubensstraße 125, 12157 Berlin, Germany.

概括

大型语言模型 (LLM) 在医学能力测试中显示出有限的推理能力,尽管在知识考试中表现强. 他们的表现在不同的认知任务和重复评估中存在显著差异.