Reference Hallucination Score for Medical Artificial Intelligence Chatbots: Development and Usability Study

Fadi Aljamaan1, Mohamad-Hani Temsah1, Ibraheem Altamimi1

  • 1College of Medicine, King Saud University, Riyadh, Saudi Arabia.

PubMed
Summary

A new reference hallucination score (RHS) evaluates AI chatbot citations in medical research. Elicit and SciSpace showed low hallucination, while ChatGPT and Bing exhibited critical levels, highlighting the need for verification tools.