Development of a large-scale medical visual question-answering dataset

Xiaoman Zhang1,2, Chaoyi Wu1,2, Ziheng Zhao1,2

  • 1Shanghai Jiao Tong University, Shanghai, China.

Communications Medicine
|December 21, 2024
PubMed
Summary

A new generative model redefines Medical Visual Question Answering (MedVQA) by integrating visual and textual data, significantly improving diagnostic accuracy. The PMC-VQA dataset aids this advancement in artificial intelligence for healthcare.