減量外科における患者教育:人工知能ベースのチャットボットは知識のギャップを埋めるのか?
Amirreza Izadi1,2, Hesam Mosavari1,2, Ali Hosseininasab1,2
1Department of Surgery, Surgery Research Center, School of Medicine, Rasool-E Akram Hospital, Iran University of Medical Sciences, Tehran, Iran, iums.ac.ir.
Journal of obesity
|February 16, 2026
まとめ
人工知能のチャットボットは,腹筋外科手術の質問に正確な答えを提供し,人間の専門家を上回った. 患者の教育には有望ですが,読解性や正確性は,臨床用途では改善する必要があります.
科学分野:
- 医療情報工学 医療情報工学
- 医療における人工知能
- 外科教育についてです.
背景:
- 世界的な肥満の流行は,代謝および減量外科手術 (MBS) のための効果的な患者教育を必要とします.
- MBSセンターの限られたリソースは,知識のギャップを生み出し,患者がオンラインで情報を検索するよう促します.
- 人工知能 (AI) のチャットボットは,信頼性の高い医療情報拡散の可能性を秘めていますが,正確性に関する懸念は残っています.
研究 の 目的:
- ラパロスコピックスリーブ胃切除術 (LSG) に関する患者の質問に答えるAIチャットボットの正確性と包括性を評価する.
- 複数のAIチャットボットのパフォーマンスを,LSGの情報提供における多学科の専門家チームと比較する.
- 患者教育のためのAIによって生成された応答の可読性と信頼性を評価する.
主な方法:
- 7つのAIチャットボット (ChatGPT 3.5/4,Bard,Bing,Claude,Llama,Perplexity) をテストした.
- 40のLSGに関する質問は,患者フォーラムやソーシャルメディアから採取されました.
- チャットボットと多学科の専門家チーム (外科医,フェロー,GP) の回答は,5ポイントスケールで正確性と包括性について評価されました.
主要な成果:
- AIチャットボットは,専門家グループ (1.92; p < 0.001) よりも全体的なパフォーマンススコア (2.55) が高くなりました.
- ChatGPT-4はチャットボットの中で最高性能 (2.94) を示し,Llamaは最低性能 (2.15) を示した.
- チャットボットの応答には,一般的に11年生から大学までの読解レベルが必要であり,ChatGPT-4が最も信頼性が高いことを示しています.
結論:
- AIチャットボットは,精度病患者の教育のためのスケーラブルなツールとして有望であり,正確で包括的な答えを生成します.
- 読みやすさ,モデルの変動性,偶発的な不正確さ,および医療法的な側面については,さらなる注意が必要です.
- チャットボットは,臨床医のカウンセリングを補完すべきであり,代替すべきではなく,将来の研究は読みやすさと現実世界への影響を改善することに焦点を当てている.

