矯正歯科治療計画開発におけるAIベースの大型言語モデルの信頼性の評価
Makara Sorel1, Chaitanya Gurrala2, Aditya Tadinada1
1Oral and Maxillofacial Radiology, University of Connecticut (UConn) School of Dental Medicine, Farmington, USA.
Cureus
|September 2, 2025
まとめ
人工知能 (AI) の大型言語モデル (LLM) は,矯正治療の計画に希望を示しています. ChatGPT-4oは,Gemini 2.0 Flash Experimentalと比較して優れた臨床的正確性とコンセンサスを示しました.
科学分野:
- 矯正歯科
- 人工知能
- 臨床的意思決定支援
背景:
- 矯正歯科の治療計画には 複雑な歯科,骨格,軟組織データが含まれます
- 臨床専門知識と証拠に基づいたガイドラインは伝統的に治療決定にインパクトを与える.
- AIの進歩,特に大きな言語モデル (LLM) は,臨床ワークフローの強化のための迅速な評価です.
研究 の 目的:
- AIベースのLLM (ChatGPT-4oとGemini 2.0 Flash Experimental) の矯正治療計画作成の能力を評価する.
- 臨床症例データから詳細で包括的な治療戦略を作成する際の異なるLLMの有効性を比較する.
主な方法:
- 出版された10件の矯正歯科症例報告を標準化された臨床インプットにまとめました.
- 治療計画を作成するために ChatGPT-4o と Gemini 2.0 Flash Experimental に入力された.
- アウトプットは 正確さ,完全さ,関連性について 矯正歯科医と矯正歯科医による独立した評価が行われました.
主要な成果:
- ChatGPT-4oはより高い臨床的アラインメントと評価者コンセンサスを達成した (クリッペンドルフのα=0. 935).
- Gemini 2.0 Flash Experimentalは,より大きな変動性と適度な合意を示した (クリッペンドルフのアルファ=0.692).
- ChatGPT-4oは,Geminiよりも関連性のある臨床的詳細を組み込み,エビデンスに基づいた標準とよりよく一致しました.
結論:
- ChatGPT-4oや Gemini 2.0 Flash Experimentalのような LLMは 矯正歯科治療の計画に 価値ある補助として役立つでしょう
- これらのAIツールは,特に日常的なケースでは,潜在的な可能性を示していますが,臨床専門知識の必要性を置き換えることはできません.
- 矯正歯科における AI の全容と限界を 探求するためにさらなる研究が必要である.


