FreeMMIF: interactive multimodal medical image fusion via instruction-aware diffusion

Huizhong Bai1, Gang Liu2, Bowen Deng1

  • 1The First Clinical Medical School, Beijing University of Chinese Medicine, Beijing, China.

Summary

FreeMMIF enables adaptive multimodal medical image fusion (MMIF) using a vision-language model (VLM) and diffusion model. Physicians can now control fusion results via text instructions for enhanced clinical diagnosis.