Large Language Model Evaluation in Traditional Chinese Medicine for Stroke: Quantitative Benchmarking Study

Hulin Long1, Yang Deng2, Yaoguang Guo1

  • 1Hospital of Chengdu University of Traditional Chinese Medicine, Chengdu, Sichuan Province, China.

JMIR Formative Research
|December 11, 2025
PubMed
Summary

Chinese-centric large language models (LLMs) excel in Traditional Chinese Medicine (TCM) knowledge recall, while general-purpose LLMs perform better in complex reasoning tasks. This study evaluated LLMs using the TCM-SED benchmark.