3DReasonKnee: Advancing Grounded Reasoning in Medical Vision Language Models

Sraavya Sambara1, Sung Eun Kim2, Xiaoman Zhang1

  • 1Department of Biomedical Informatics, Harvard Medical School, Boston, MA, USA.

Summary

This study introduces 3DReasonKnee, a novel dataset for 3D medical imaging, enabling vision-language models (VLMs) to perform grounded reasoning for enhanced diagnostic accuracy. It benchmarks VLM performance in localizing anatomical regions and assessing severity in knee MRIs.