Marco de referencia clínicamente informado para evaluar modelos de visión y lenguaje en la generación de informes de

Hao Guan1,2, Peter C Hou1,2, Pengyu Hong3

  • 1Brigham and Women's Hospital, Boston, MA.

Resumen

Este estudio presenta un nuevo marco para evaluar informes de radiología generados por IA, centrándose en los riesgos clínicos. Revela errores comunes en los modelos de visión y lenguaje (VLM), mejorando la seguridad de la IA en imágenes médicas.