ChatGPT-4oによるIPSSおよびOABSSスコアの推定:韓国における比較検証研究
Hoyoung Bae1,2, Gyu Min Lee1,2, Jiehyeon Lee1,2
1Department of Urology, Seoul National University Boramae Medical Center, Sindaebang 2(i)-dong, Dongjak-gu, Seoul, 07061, Korea.
ChatGPT-4oは、国際前立腺症状スコア(IPSS)と過活動膀胱症状スコア(OABSS)の推定において中程度の精度を示し、臨床データ収集を支援する可能性を示しました。
科学分野:
- ヘルスケアにおける人工知能;泌尿器科学;臨床情報学
背景:
- 国際前立腺症状スコア(IPSS)および過活動膀胱症状スコア(OABSS)などの患者報告アウトカム尺度(PROM)は、下部尿路症状(LUTS)および過活動膀胱(OAB)の診断と管理に不可欠です。正確な症状スコアリングは、患者の想起と質問票の記入に依存しており、これらはエラーや省略の対象となる可能性があります。ChatGPT-4oのような大規模言語モデル(LLM)は、臨床記録からのデータ抽出と分析のための新しい可能性を提供します。
研究 の 目的:
- 自然言語記述および外来記録全体を使用して、IPSSおよびOABSSを推定する上でのChatGPT-4oのパフォーマンスを評価すること。AI生成スコアと実際の患者報告質問票スコアを比較すること。
主な方法:
- 91人の患者が参加し、52人がIPSSを、77人がOABSSを完了しました。ChatGPT-4oは、患者の症状のそのままの記述と泌尿器科医が書いた診療記録を処理しました。統計分析には、スコアと診断分類の比較のために、ペアt検定、Cohenのkappa、Spearman相関、Bland-Altmanプロット、McNemar検定、ROC曲線分析が含まれました。
主要な成果:
- ChatGPT-4oは平均IPSSを過小評価しましたが(11.2対13.6、p=0.006)、OABSSでは有意差を示しませんでした(6.99対6.86、p=0.686)。LUTS(AUC 0.81)およびOAB(AUC 0.91)で高い診断一致率が観察され、生活の質と切迫性尿失禁でも良好な一致が見られました。IPSSのSpearman相関係数は0.60、OABSSは0.70であり、中程度から強い相関を示しました。
結論:
- ChatGPT-4oは、IPSSおよびOABSSの推定において、臨床的に許容可能な中程度の精度を達成しました。AIの診断分類パフォーマンスは、特にOABSSおよび生活の質において、実際のスコアに匹敵しました。ChatGPT-4oは、特に患者データが不完全な場合に、従来の質問票の補完ツールとして有望です。
さらに関連する動画
15:49Flexible Colonoscopy in Mice to Evaluate the Severity of Colitis and Colorectal Tumors Using a Validated Endoscopic Scoring System
Published on: October 16, 2013
06:14In Vivo Protocol of Controlled Subconcussive Head Impacts for the Validation of Field Study Data
Published on: April 18, 2019
関連する概念動画
Reliability and Validity
Imaging Studies for Cardiovascular System VI: Calcium -Scoring CT
Introduction to z Scores
z scores...
Introduction to z Scores
z scores...
z Scores and Area Under the Curve
What are Estimates?
The estimate for the mean of a sample is denoted by ͞x, whereas the mean of the population is designated as μ. Further, parameters such...
