Beyond accuracy: evaluating the reliability of large language models for medical assessment

Hui Zhang1, Lihui Qu2, Hongbo Bai2

  • 1Office of Academic Affairs, Guangzhou Medical University, Guangzhou, China.

Abstract