口腔粘膜病変の分析におけるChatGPT-4oの診断性能:専門家による比較研究
Luigi Angelo Vaira1, Jerome R Lechien2,3, Antonino Maniaci4
1Maxillofacial Surgery Operative Unit, Department of Medicine, Surgery and Pharmacy, University of Sassari, 07100 Sassari, Italy.
Medicina (Kaunas, Lithuania)
|August 28, 2025
まとめ
この試験試験では,ChatGPT-4oが画像から口腔粘膜の病変を正確に分析し,91. 7%の感度と100%の特異性を得ることが示されています. 人工知能によるトリアージは 望ましいですが 悪性病変については 専門家の監督が必要です
科学分野:
- 口腔医学
- 医療における人工知能
- 診断画像分析
背景:
- 口腔粘膜の病変は,正確かつ適時な診断を必要とします.
- 人工知能のツールは 診断の効率とアクセシビリティを改善する可能性を秘めています
研究 の 目的:
- 臨床画像を用いて口腔粘膜の病変に対するChatGPT-4oの診断精度を評価する.
- 専門医の診断と比較してChatGPT-4oの性能を評価する.
主な方法:
- 110の臨床画像 (100の病変,10の健康な) をChatGPT-4oで分析した.
- 専門家パネルは基準診断を確立し,AI診断を比較した.
- 精度,感度,特異性,AIPIのスコアを計算した.
主要な成果:
- ChatGPT-4oは,全体の診断精度で85%を達成しました.
- 敏感度は91. 7%,特異性は100%でした.
- AIPIスコアは,専門家の診断と有意な差異がない強い診断推論を示した (p=0. 084).
結論:
- ChatGPT-4oは,口腔粘膜の病変に対する高い診断精度と記述能力を示しています.
- AIは,特にサービス不足の地域で,トリアージ・アイドとして潜在性を示しています.
- 悪性病変の偽陰性の割合は小さいため,専門家の継続的な臨床監督が必要である.


