评估ChatGPT-4在儿科牙科问题上的表现:准确性和完整性分析
Berkant Sezer1, Alev Eda Okutan2
1Department of Pediatric Dentistry, School of Dentistry, Çanakkale Onsekiz Mart University, Çanakkale, Türkiye. dt.berkantsezer@gmail.com.
BMC oral health
|September 24, 2025
概括
聊天生成预训练变压器-4 (ChatGPT-4) 在回答来自患者和课程的儿科牙科问题方面表现出高准确性. 虽然完整性是适度的,但建议对化物和脉疗法等特定主题进行专业监督.
科学领域:
- 医疗保健中的人工智能
- 儿科牙科 儿科牙科
- 医学教育 医学教育
背景情况:
- 像ChatGPT-4这样的AI工具在医疗保健和教育中的整合正在迅速扩大.
- 评估人工智能产生的内容的可靠性对于患者安全和有效的学习至关重要.
研究的目的:
- 评估ChatGPT-4对儿科牙科常见问题和课程问题的答案的准确性和完整性.
- 为了确定ChatGPT-4的性能是否在不同的儿科牙科主题中有所不同.
主要方法:
- 在6个儿科牙科主题中,ChatGPT-4对30个患者/家长常见问题和30个课程问题产生了响应.
- 30名儿科牙医评估了响应的准确性 (5分利克尔特尺度) 和完整性 (3分尺度).
- 统计分析包括费舍尔的精确测试,曼-惠特尼U测试,克鲁斯卡尔-瓦利斯测试和邦费罗尼调整后期比较.
主要成果:
- 聊天GPT-4在常见问题 (平均4.21) 和课程问题 (平均4.16) 两方面都表现出很高的准确性,被评为"好"到"优秀".
- 完整度得分中等 (FAQ:2.51,课程:2.61),表明可以接受的覆盖范围.
- 在课程问题上,准确性因主题而异 (p=0.007),裂密封剂得分最高,脉治疗得分最低.
结论:
- 聊天GPT-4显示了有希望的准确性和可接受的完整性,用于儿科牙科通信.
- 在化物和脉治疗等特定领域的表现需要仔细考虑和专业监督.
- 人工智能工具可以在儿科牙科中成为有价值的辅助工具,但需要专家验证.


