,,

Gang Liu1, Jinlong He1, Pengfei Li1

  • 1College of Computer Science and Technology, Harbin Engineering University, Harbin, 150001, Heilongjiang, China.

PubMed
概括

本研究介绍了医疗视觉问题答案 (VQA) 的多重目标 (CMMO) 交叉模式预培训. 通过将医疗图像特征与文本概念对齐,CMMO显著提高了VQA的性能,在多个数据集上表现优于现有的方法.