Los modelos de lenguaje de visión compactos permiten un análisis automatizado e interpretable de los PTU a través del

Tania Haghighi1, Sina Gholami1, Jared Todd Sokol2

  • 1Department of Electrical and Computer Engineering, University of North Carolina at Charlotte, Charlotte, NC 28223, USA.

Resumen

Desarrollamos LO-VLM, un eficiente modelo de IA para interpretar escáneres OCT B, para generar narrativas clínicas precisas y clasificar enfermedades de la retina. Este modelo de lenguaje visual supera significativamente a los métodos existentes tanto en la generación de resúmenes como en la precisión del diagnóstico.