:

Jean Seo1, Sumin Park2, Sungjoo Byun1

  • 1Department of Linguistics, Seoul National University, Seoul, Korea.

概括

韩国医疗偏好数据集 (KoMeP) 增强了生物医学中的大型语言模型 (LLM). 直接偏好优化 (DPO) 在对齐调整方面显示出优于赔率偏好优化 (ORPO) 的性能.

相关概念视频