A survey on advancements in image-text multimodal models: From general techniques to biomedical implementations

Ruifeng Guo1, Jingxuan Wei1, Linzhuang Sun1

  • 1Shenyang Institute of Computing Technology, Chinese Academy of Sciences, Shenyang, 110168, China; University of Chinese Academy of Sciences, Beijing, 100049, China.