脉和近脉疾病的知识水平比较:牙科学生与人工智能模型 (Gemini,微软Copilot,ChatGPT-3.5,ChatGPT-4o):横截面研究
1Faculty of Dentistry, Department of Endodontics, Aksaray University, Bahçesaray Neighborhood, Necmettin Erbakan Boulevard, Campus Road, Aksaray, 68100, Turkey. Ozgekrtrs@gmail.com.
BMC medical education
|November 27, 2025
概括
人工智能 (AI) 聊天机器人在诊断脉和周围脉疾病方面表现出不同的准确性. 聊天GPT-4o的表现与经验丰富的牙科学生相比,突出了AI.
科学领域:
- 牙科诊断和人工智能 牙科诊断和人工智能
- 内牙教育和决策支持.
背景情况:
- 人工智能聊天机器人对牙科临床教育和决策的兴趣日益增长.
- 需要评估人工智能的诊断准确性,用于脉和周围脉疾病.
研究的目的:
- 为了比较牙科学生和AI聊天机器人的诊断准确度 (ChatGPT-3.5,ChatGPT-4o,Gemini,微软Copilot).
- 根据AAE指南,评估AI在回答有关脉和周围脉疾病的问题上的表现.
主要方法:
- 三年级和五年级牙科学生和四个人工智能聊天机器人回答了15个多选题.
- 问题基于2020年美国内牙科医生协会 (AAE) 临床指南.
- 使用统计分析 (ANOVA,Chi-square) 将准确率进行比较.
主要成果:
- 五年级牙科学生的准确度最高 (85.1%),其次是ChatGPT-4o (79.6%).
- 聊天GPT-4o的准确性与经验丰富的学生相比 (p>0.05).
- 第三年级学生 (64.9%),双子座 (71.6%) 和微软Copilot (61.3%) 的表现较低.
结论:
- 人工智能聊天机器人展示了脉和周围脉疾病的可变诊断准确性.
- 聊天GPT-4o显示出作为牙科教育和临床决策支持的支持工具的潜力.
- 人类专业知识仍然至关重要,因为人工智能不能完全取代临床判断.


