在儿科化物教育中探索人工智能聊天机器人:一个横截面研究
Nevra Karamüftüoğlu1, Ezgi Aydın Varol2, Cenkhan Bal3
1Department of Pediatric Dentistry, Gülhane Faculty of Dentistry, University of Health Sciences, Ankara, 06010, Turkey. nvrserbest@hotmail.com.
Scientific reports
|November 29, 2025
概括
与Gemini Pro和DeepSeek V3相比,ChatGPT-4.o在向家长提供化物信息方面表现出更高的可靠性和信息质量. 这种人工智能工具显示了儿童牙科护理人员教育的潜力,提高了对化物使用的理解.
科学领域:
- 医疗保健中的人工智能
- 儿科牙科 儿科牙科
- 卫生沟通健康沟通
背景情况:
- 大型语言模型 (LLM) 聊天机器人越来越多地用于医疗保健,以获得可访问的信息.
- 化物对于预防儿科空至关重要,但面临着公众的担忧和错误信息.
- 需要可靠的数字通信来解决护理人员关于化物使用的问题.
研究的目的:
- 评估先进的人工智能聊天机器人 (ChatGPT-4.o,Gemini Pro,DeepSeek V3) 在为儿科口腔健康提供化物相关信息方面的性能.
- 评估聊天机器人对护理人员查询的答案的质量,可靠性,可读性和原创性.
主要方法:
- 一项观察性研究向三个AI聊天机器人提出了20个与化物有关的问题.
- 通过使用验证的工具 (EQIP,DISCERN,GQS,FRES,FKRGL,iThenticate) 的三个盲目审查员评估了答案.
- 统计分析包括ANOVA/Kruskal-Wallis测试和ICC测试,以检测评审者之间的可靠性.
主要成果:
- 在EQIP和DISCERN分数 (p < 0.001) 中,ChatGPT-4.o显著优于Gemini Pro和DeepSeek V3,这表明了卓越的可靠性和信息质量.
- 聊天GPT-4.o产生了更易于阅读和更原始的内容,尽管Flesch阅读易度得分 (FRES) 和相似度指数没有显著差异.
- 弗莱什-金凯德阅读等级水平 (FKRGL) 的差异是边界的,在校正后没有统计学意义;全球质量表 (GQS) 的结果是可比的.
结论:
- 在评估的模型中,ChatGPT-4.o展示了对儿科口腔健康的化物最清晰,最可靠的沟通.
- 它的较高分数表明它有可能成为护理人员教育的支持工具,提高对化物使用的理解.
- 建议谨慎实施,专业监督和持续验证,以防止错误信息,并确保安全的临床整合.


