肩の不安定性に関する人工知能によって生成された患者の情報は依然として最適ではありません:DeepSeekは,コンテンツの完全性においてChatGPTを上回りますが,ChatGPTはより読みやすいです
Erman Öğümsöğütlü1, Bahri Bozgeyik2, Gazi Huri3,4
1Department of Orthopaedics and Traumatology, Yalova Training and Research Hospital, Yalova, Turkey.
まとめ
DeepSeek AIは,ChatGPTと比較して,肩の不安定性に関する情報のコンテンツ品質において優れたパフォーマンスを示し,完全性と全体的なスコアで卓越した. しかし,ChatGPTは,患者の教育のためによりよい読みやすさを提供しました.
科学分野:
- 医療における人工知能
- 医療教育 テクノロジー テクノロジー
- 整形外科患者の情報システム
背景:
- 患者の教育は,肩の不安定性の管理に不可欠です.
- 人工知能 (AI) モデルは,健康情報を広めるための潜在的なツールを提供します.
- 正確でアクセシブルな医療情報を提供するAIの有効性を評価することは不可欠です.
研究 の 目的:
- 肩の不安定性に関する患者の情報を提供するチャットGPTとディープシークAIモデルのパフォーマンスを比較する.
- 肩の不安定性に対するAIによって生成された応答のコンテンツの品質と読みやすさを評価する.
主な方法:
- 肩の不安定性に関する16のよくある質問がChatGPTとDeepSeekに提出されました.
- 回答は,JAMA基準,DISCERN,およびコンテンツ品質の4ポイントのLikertスケールを使用して評価されました.
- 読みやすさは,フレッシュ-キンケイド読みやすさスコア (FRES) とフレッシュ-キンケイドグレードレベル (FKGL) を使用して評価されました.
主要な成果:
- どちらのAIモデルも,患者情報に関するJAMAの基準を満たしていない.
- DeepSeekは,DISCERNスコア (52.81対48.5) と完全性 (p<0.001) でChatGPTを大幅に上回りました.
- ChatGPTは,DeepSeek (FKGL 9.90, FRES 41.87) と比較して,より優れた読みやすさ (FKGL 7.78, FRES 52.44) を示しました.
結論:
- 両方のAIモデルは,肩の不安定性の患者教育のために,一般的に正確で臨床的に関連する情報を提供します.
- DeepSeekはコンテンツ品質メトリック (DISCERN,完全性) で優れているが,ChatGPTはより優れた読みやすさを提供している.
- AIモデルは,肩の不安定性に対する患者教育ツールとしての潜在能力を示しており,それぞれが明確な強みを持っています.

