Evaluación de grandes modelos de lenguaje como clasificadores de preguntas médicas de respuestas cortas: un análisis

Olena Bolgova1, Paul Ganguly1, Muhammad Faisal Ikram1

  • 1College of Medicine, Alfaisal University, Riyadh, Kingdom of Saudi Arabia.

Medical education online
|August 24, 2025
PubMed
Resumen

Los Grandes Modelos de Lenguaje (LLM) son prometedores para la calificación de preguntas médicas de respuestas cortas, pero el rendimiento varía según el modelo y la disciplina médica. Los criterios de expertos no mejoraron consistentemente la precisión de LLM, lo que requirió la implementación específica del dominio y la supervisión humana.