MedExpQA:

Iñigo Alonso1, Maite Oronoz1, Rodrigo Agerri1

  • 1HiTZ Center - Ixa, University of the Basque Country UPV/EHU, Spain.

概括

大型语言模型在医疗人工智能方面表现有前途,但与过时的信息和幻觉作斗争. 一个新的多语言基准,MedExpQA,揭示了显著的绩效差距,特别是对于非英语语言.