Data Set and Benchmark (MedGPTEval) to Evaluate Responses From Large Language Models in Medicine: Evaluation

Jie Xu1, Lu Lu1, Xinwei Peng1

  • 1Shanghai Artificial Intelligence Laboratory, OpenMedLab, Shanghai, China.

PubMed
Abstract

Related Concept Videos