妊娠糖尿病のためのAIチャットボットの有効性,信頼性,読みやすさの評価:マルチモデル比較研究
Xinxin Wang1, Shuyan Lin1, Hui Liu1
1Department of Obstetrics, Shenzhen Nanshan Maternity and Child Healthcare Hospital, Shenzhen, China.
Frontiers in public health
|February 20, 2026
まとめ
人工知能 (AI) のチャットボットは,妊娠糖尿病 (GDM) 情報の精度が向上し,新しいモデルは古いモデルを上回っています. しかし,透明性と読解性の問題により,まだ独立した患者教育リソースとして適していません.
科学分野:
- 医療における人工知能
- 医療情報工学 医療情報工学
- 公衆衛生は公衆衛生である.
背景:
- 妊娠中糖尿病 (GDM) は,母親と乳児にとって重大なリスクを持つ世界的な健康上の懸念が増加しています.
- 正確でアクセス可能な健康情報は,GDMの管理に不可欠です.
- 健康に関する問い合わせのためにAIチャットボットの使用は増加していますが,GDMに関連する情報の質は不確実です.
研究 の 目的:
- 妊娠糖尿病 (GDM) 情報のAIチャットボットの正確性,信頼性,読みやすさを評価する.
- GDMに関連する質問に関する異なるAIモデルと世代のパフォーマンスを比較する.
- GDMにおける患者教育のためのAIチャットボットの適性を評価する.
主な方法:
- 6つのAIチャットボットは,疫学,診断,結果,管理をカバーするGDMに関する200の複数選択質問 (MCQ) を使用して評価されました.
- 4つのチャットボットは,Google Trendsと専門家のレビューを通じて特定された15のGDM教育コア質問で評価されました.
- 信頼性はDISCERN,EQIP,GQS,JAMAのベンチマークを用いて評価され,可読性はARI,CL,FKGL,FRES,GFI,SMOGの指標を用いて定量化されました.
主要な成果:
- ChatGPT-5は最高レベルのMCQ精度 (92.17%) を示し,新しいモデルは一貫して古いモデルを上回っている.
- また,ChatGPT-5は,公衆向け情報では最も高い信頼性スコアを達成したが,JAMAのスコアは透明性が低いことを示した.
- すべてのチャットボットは,推奨読解レベルを超えるテキストを生成し,ChatGPT-5は最も好ましい,しかしまだ不十分な読解性プロファイルを持っています.
結論:
- 現在のAIチャットボットは,一般的に正確で適度に信頼性の高いGDM情報を提供し,新しい世代では顕著な改善がなされています.
- 制限された透明性と高い読解レベルは,AIチャットボットがGDM患者の教育のためにまだ理想的なスタンドアロンリソースではないことを意味します.
- AIチャットボットは,GDMのための臨床医のカウンセリングと専門的に開発された教育資料を補完すべきであり,置き換えるべきではありません.

