VT-MFLV: Red de Aprendizaje de Características Multimodales Visión-Texto para Segmentación de Imágenes Médicas

Wenju Wang1, Jiaqi Li1, Zinuo Ye1

  • 1College of Publishing, University of Shanghai for Science and Technology, Shanghai 200093, China.

Journal of imaging
|December 24, 2025
PubMed
Resumen

Una nueva Red de Aprendizaje de Características Multimodales Visión-Texto (VT-MFLV) mejora la segmentación de imágenes médicas al integrar datos de texto. Este enfoque mejora la precisión del reconocimiento de lesiones, logrando resultados líderes a nivel mundial en conjuntos de datos de infección pulmonar.