A multimodal benchmark dataset for evaluating large language models on traditional Chinese opera understanding

Gengxian Cao1, Shuo Hou2, Ye Yang3

  • 1The Music Education Center at the School of Humanities, Xi'an Jiaotong University, Xi'an, China.

Scientific Data
|June 30, 2026
PubMed
Summary

Researchers developed the TCO-Dataset, a new bilingual benchmark for evaluating large language models (LLMs) on traditional Chinese opera images. This dataset aids in assessing AI

Related Concept Videos