,

Michael J Borowitz1, Amanda L Blackford2, Suman Nagelia3

  • 1Department of Pathology, Sol Goldman Pancreatic Cancer Research Center, Johns Hopkins University School of Medicine, Baltimore, Maryland; Sidney Kimmel Comprehensive Cancer Center, Johns Hopkins University School of Medicine, Baltimore, Maryland.

概括

大型语言模型 (LLM) 可以生成病理学测试问题,但仍然需要人类专家来实现最佳质量. 虽然LLM生成的问题显示质量较差的例子略多,但它们的整体好或优秀评分与人类撰写的问题相似.