牙科教育中的人工智能:ChatGPT在牙周科职业考试中的表现
Arman Danesh1, Hirad Pazouki2, Farzad Danesh3
1Schulich School of Medicine and Dentistry, Western University, London, Ontario, Canada.
Journal of periodontology
|January 10, 2024
概括
聊天GPT (聊天生成预训练变压器) 在牙周学教育中显示出潜力,但存在错误信息的风险. 聊天GPT3.5和聊天GPT4都需要牙科学生仔细审查以确保准确性.
科学领域:
- 人工智能在医疗保健教育中的应用
- 牙科教育技术 牙科教育技术
- 牙周学知识评估知识评估
背景情况:
- 聊天GPT的人类式文本生成为医疗学生提供学习机会.
- 人工智能响应中的不准确性构成错误信息的重大风险.
- 在牙周科等专业领域,评估像ChatGPT这样的AI工具至关重要.
研究的目的:
- 评估ChatGPT在牙周病学方面的知识基础.
- 为了评估ChatGPT响应的准确性,使用一项既定的检查.
- 识别人工智能辅助牙科教育中的潜在错误信息风险.
主要方法:
- 聊天GPT3.5和聊天GPT4在2023年美国牙周病学会 (AAP) 现役考试中的311个选择题中进行了测试.
- 需要图像输入的问题被排除在外.
- 统计分析包括双尾t和χ2试验,显著程度为p < 0.05.
主要成果:
- 聊天GPT3.5的准确率达到57.9%,而聊天GPT4的准确率达到73.6%.
- 在两个模型之间观察到一个统计学上显著的差异.
- 两种模型都表明在提供准确的牙周信息方面存在局限性.
结论:
- 聊天GPT4的表现优于聊天GPT3.5,但这两种模式都存在假牙学错误信息的风险.
- 由于目前的局限性,牙科住院医生必须批判性地评估人工智能生成的内容.
- 需要进一步的研究来完善人工智能工具,以提供准确的牙科教育.


