LLM-as-a-judge

Yuriy Vasilev1, Irina Raznitsyna1, Anastasia Pamova1,2

  • 1Research and Practical Clinical Center for Diagnostics and Telemedicine Technologies of the Moscow Health Care Department, 127051 Moscow, Russia.

PubMed
まとめ

大規模言語モデル(LLM)は、電子健康記録(EHR)の要約に有望であることを示しています。しかし、LLM-as-a-judgeを含む自動品質管理方法は、事実誤認を検出するのが難しく、専門家によるレビューが必要です。