Let large language models judge each other: multi-agent peer-reviewed reasoning for medical question answering

Zaifu Zhan1, Shuang Zhou2, Rui Zhang2

  • 1Department of Electrical and Computer Engineering, University of Minnesota, Minneapolis, MN 55455, United States.

Summary

A new multi-agent peer-reviewed reasoning method enhances large language models (LLMs) for medical question answering (MedQA). This approach improves accuracy and interpretability by having LLM agents evaluate each other