评估人工智能对话模型在提供有关牙科植入物的信息:对ChatGPT,Gemini和MedGebra进行比较分析
Georgios Kofos1, Anastasia Fardi1, Theodoros Lillis1
1Department of Oral Surgery, Implantology and Oral Radiology, School of Dentistry, Aristotle University of Thessaloniki, Thessaloniki, Greece.
Journal of evaluation in clinical practice
|November 2, 2025
概括
与MedGebra相比,ChatGPT和Gemini在回答牙科植入物问题方面表现出更高的准确性和清晰度. 这些人工智能 (AI) 聊天机器人对患者教育充满希望,专业监督至关重要.
科学领域:
- 牙科植入物学 牙科植入物学
- 医疗保健中的人工智能
- 医疗信息检索 医疗信息检索
背景情况:
- 牙科植入物信息对于患者的理解至关重要.
- 评估人工智能生成的医疗信息的可靠性变得越来越重要.
- 大型语言模型 (LLM) 为患者教育提供了潜力.
研究的目的:
- 为了比较三种AI模型 (ChatGPT,Gemini,MedGebra) 对牙科植入物问题的答案的准确性,精度和清晰度.
- 评估AI聊天机器人对于牙科患者教育的适用性.
主要方法:
- 这是一项横截面研究,使用了EAO患者指南中的56个问题.
- 两个口腔外科专家独立评估了ChatGPT,Gemini和MedGebra的反应.
- 用四点的利克尔特度表来评估正确性,精度和清晰度.
主要成果:
- 聊天GPT获得了最高分,特别是在清晰度方面.
- 双子号显示的清晰度与ChatGPT相似,但准确度和精度较低.
- 在所有评估标准中,MedGebra获得了最低的评分.
- 评审者间的可靠性表明,在审查者之间存在一些差异.
结论:
- 与MedGebra相比,ChatGPT和Gemini对牙科植入物提供了更准确和更具信息性的反应.
- 人工智能聊天机器人有可能提高牙科植入患者的教育.
- 专业监督对于确保人工智能生成信息的准确性和可靠性至关重要.


