A transformer-based representation-learning model with unified processing of multimodal input for clinical

Hong-Yu Zhou1, Yizhou Yu2, Chengdi Wang3

  • 1Department of Computer Science, The University of Hong Kong, Pokfulam, China.

PubMed
Summary

A new transformer model unifies diverse clinical data, including images and text, for improved diagnostic accuracy. This multimodal approach enhances disease identification and outcome prediction in healthcare settings.