Detección de alucinaciones en grandes modelos de lenguaje utilizando entropía semántica

Sebastian Farquhar1, Jannik Kossen2, Lorenz Kuhn2

  • 1OATML, Department of Computer Science, University of Oxford, Oxford, UK. sebfar@gmail.com.

Nature
|June 19, 2024
PubMed
Resumen

Los investigadores desarrollaron un nuevo método estadístico para detectar confabulaciones, un tipo de alucinación, en grandes modelos de lenguaje (LLM). Este enfoque identifica salidas de IA no confiables midiendo la incertidumbre a nivel semántico, mejorando la confiabilidad de la IA.