Med3DVLM: Un modelo de lenguaje de visión eficiente para el análisis de imágenes médicas en 3D

Resumen

Med3DVLM, un nuevo modelo de lenguaje de visión 3D (VLM), mejora el análisis de imágenes médicas 3D con una eficiente extracción de características espaciales y una mejor alineación de imágenes con texto. Este modelo logra un rendimiento superior en tareas de recuperación, generación de informes y respuesta visual a preguntas.