使

Sebastian Farquhar1, Jannik Kossen2, Lorenz Kuhn2

  • 1OATML, Department of Computer Science, University of Oxford, Oxford, UK. sebfar@gmail.com.

Nature
|June 19, 2024
PubMed
概括

研究人员开发了一种新的统计方法来检测大语言模型 (LLM) 中的一种幻觉. 这种方法通过测量语义层面的不确定性来识别不可靠的AI输出,从而提高AI的可靠性.