アルゴリズムから答えまで:一般的な検索エンジンと,足のの患者の教育に関する大規模な言語モデルの比較分析
Daniel E Pereira1, Ndeye F Guisse, Rohit Siddabattula
1Department of Orthopaedics, Washington University School of Medicine, St. Louis, Missouri, USA.
Journal of pediatric orthopedics. Part B
|September 1, 2025
まとめ
チャット・ジェネラティブ・プレ・トレインド・トランスフォーマー4o (ChatGPT-4o) は,小児足の治療について,Googleよりも臨床的に関連した質問を提供しています. 両方のソースは正確な答えを提供していますが,ChatGPT-4oはより学術的なソースを使用しており,学術的な患者情報の可能性を示唆しています.
科学分野:
- 医療情報工学
- 医療における人工知能
- 小児整形外科
背景:
- オンライン検索エンジンは 医療情報を求める患者によって よく使われます
- 人工知能によって生成された健康情報の品質と関連性を評価することは極めて重要です.
- 小児足の治療に関する情報は,正確で適切な情報源が必要です.
研究 の 目的:
- チャットGPT-4oとGoogleの臨床的関連性と正確さを,小児の足首の治療に関するクエリと比較する.
- 両方のプラットフォームで使用するソースの種類を評価する.
- 患者中心の整形医療情報を提供するための大規模な言語モデルの有用性を決定する.
主な方法:
- チャットGPT-4oとGoogleに15の一般的な小児足の治療に関する質問が寄せられました.
- 回答の臨床的関連性と正確性は,修正されたロスウェル基準を用いて評価された.
- 専門の小児整形外科医が 評価を検証し 不一致を解決しました
主要な成果:
- ChatGPT-4oの反応は,臨床的関連性において有意に高く評価された (P=0. 006).
- 臨床的精度はChatGPT-4oとGoogle (P=0. 570) と同等であった.
- ChatGPT-4oは主に学術的なソースを使用し,Googleは学術的および政府のプラットフォームを含んでいた.
結論:
- チャットGPT-4oは,Googleと比較して,小児足の治療に関する質問に優越した臨床的関連性を示しています.
- 両方のプラットフォームは臨床的に正確な情報を提供しますが,AIモデルはより学術的なコンテンツを提供することができます.
- 臨床使用のためのAIツールを検証し,誤った情報を防ぐためにさらなる研究が必要です.


