在分析口腔粘膜病变时,ChatGPT-4o的诊断性能:与专家进行的比较研究
Luigi Angelo Vaira1, Jerome R Lechien2,3, Antonino Maniaci4
1Maxillofacial Surgery Operative Unit, Department of Medicine, Surgery and Pharmacy, University of Sassari, 07100 Sassari, Italy.
Medicina (Kaunas, Lithuania)
|August 28, 2025
概括
这项试点研究表明,ChatGPT-4o可以准确地从图像中分析口腔粘膜病变,达到91.7%的灵敏度和100%的特异性. 虽然对人工智能驱动的分类有希望,但对于恶性病变仍然需要专家监督.
科学领域:
- 口腔医学
- 医疗保健中的人工智能
- 诊断成像分析
背景情况:
- 口腔粘膜病变需要准确及时诊断.
- 人工智能工具有助于提高诊断效率和可访问性.
研究的目的:
- 用临床图像评估ChatGPT-4o对口腔粘膜病变的诊断准确性.
- 根据临床专家的诊断来评估ChatGPT-4o的性能.
主要方法:
- 使用ChatGPT-4o分析了110张临床图像 (100张病变,10张健康图像).
- 专家小组确定了参考诊断;AI诊断进行了比较.
- 计算了准确性,敏感性,特异性和AIPI得分.
主要成果:
- 查特GPT-4o的整体诊断准确率达到了85%.
- 在病变分类方面,敏感度为91. 7%,特异性为100%.
- AIPI评分显示强烈的诊断推理,与专家诊断没有显著差异 (p=0.084).
结论:
- 在口腔粘膜病变方面,ChatGPT-4o具有很高的诊断准确性和描述能力.
- 人工智能显示出作为分类援助的潜力,特别是在服务不足的地区.
- 恶性病变的虚假阴性率很小,需要持续专家临床监督.


