相关实验视频
Updated: Jun 20, 2025

07:16
Extraction of the EPP Component from the Surface EMG
Published on: December 16, 2009
12.5K
评估GPT-4V在日本国家牙科检查中的表现:一个挑战探索
Masaki Morishita1,2, Hikaru Fukuda3, Kosuke Muraoka1
1Division of Clinical Education Development and Research, Department of Oral Function, Kyushu Dental University, Kitakyushu, Japan.
Journal of dental sciences
|July 22, 2024
概括
在基于图像的牙科检查问题上,ChatGPT-4V的准确性有限,得分为35%. 虽然它对一些牙科专业有希望,但对于复杂的临床场景和图像沉重的内容,它需要改进.
科学领域:
- 人工智能在牙科中的应用
- 医疗教育 技术 技术 医学教育
- 牙科检查评估 牙科检查评估
背景情况:
- 人工智能的进步推动了人们对医疗和牙科应用的兴趣.
- 图像识别能力正在迅速发展.
- 人工智能工具正在探索用于教育支持.
研究的目的:
- 评估ChatGPT-4V在基于图像的日本国家牙科考试 (JNDE) 问题上的表现.
- 评估其作为牙科学生教育支持工具的潜力.
- 识别人工智能在牙科教育中的优缺点.
主要方法:
- 从2023年1月的JNDE中利用了基于图像的问题.
- 在ChatGPT-4V.中输入标准化提示,问题文本和图像.
- 使用Qlik Sense®和GraphPad Prism进行数据和统计分析.
主要成果:
- 在基于图像的JNDE问题上,ChatGPT-4V的整体正确答案率为35.0%.
- 根据问题类型的表现有所不同:57.1%是强制性问题,43.6%是一般性问题,28.6%是临床实践问题.
- 在牙科麻醉学和内科医疗中更高的准确性 (>70%),在正牙科和口腔外科中更低;更多的图像与更低的准确性相关.
结论:
- 聊天GPT-4V的图像识别有局限性,特别是在复杂的临床实践和图像密集型问题上.
- 目前,它还不完全适合作为牙科学生的教育支持工具.
- 建议使用更大的数据集进行进一步的技术改进和评估.

