Cardiology knowledge assessment of retrieval-augmented open versus proprietary large language models

Constantine Tarabanis1, Shaan Khurshid2,3,4, Areti Karamanou5

  • 1Cardiology Division, Heart and Vascular Institute, Mass General Brigham, Boston, Massachusetts, United States of America.

PLOS Digital Health
|March 12, 2026
PubMed
Summary

Open-weight large language models (LLMs) show strong performance in cardiology questions, with some models outperforming human averages. Retrieval-Augmented Generation (RAG) further enhances performance, especially for smaller models.