人工智能平台的比较分析:ChatGPT-3.5和GoogleBard在识别腰部疼痛的红旗方面
Selkin Yilmaz Muluk1, Nazli Olcucu2
1Physical Medicine and Rehabilitation, Antalya City Hospital, Antalya, TUR.
Cureus
|August 1, 2024
概括
像ChatGPT和Google Bard这样的AI聊天机器人准确地回答有关腰部疼痛红旗的问题. 这些工具有效地传达病情的严重程度,显示在线健康信息传递的前景.
科学领域:
- 医疗信息学 医疗信息学
- 医疗保健中的人工智能
- 临床决策支持 临床决策支持
背景情况:
- 腰部疼痛 (LBP) 是一个常见的健康问题,通常可以通过保守的护理来控制.
- 严重的LBP原因需要警"红旗" (RF),如恶性瘤或骨折.
- 患者越来越多地在网上搜索健康信息,突出了需要准确的AI驱动资源的需求.
研究的目的:
- 评估ChatGPT-3.5和谷歌Bard在响应与红旗相关的腰痛查询中的准确性.
- 评估人工智能模型根据用户输入的症状来辨别LBP条件的严重程度的能力.
主要方法:
- 根据临床指南,根据RF相关的LBP症状和疾病制定了70个问题.
- 58个单症状 (SS) 和12个多症状 (MS) LBP问题被提出给ChatGPT-3.5和谷歌Bard.
- 两位作者对答案的准确性,完整性和相关性 (ACR) 进行了评估,使用了5分标记,与高评级者之间达成一致 (科恩的卡帕:0.60-0.81).
主要成果:
- 两种人工智能模型都为他们的反应提供了"好"到"优秀"的评级.
- 聊天GPT-3.5和谷歌巴德在3.36-4.29之间获得了平均ACR分数,多症状问题得分更高.
- 人工智能反应有效地传达了超过93%的单症状病例和100%的多症状病例的病情严重程度.
- 在ChatGPT-3.5和谷歌巴德之间没有观察到统计学上显著的性能差异 (p>0.05).
结论:
- 人工智能系统在解决与腰部疼痛相关的红旗症状方面表现出显著的准确性.
- 这些人工智能工具显示出提供可靠在线健康信息的潜力,特别是关于严重的医疗状况.
- 人工智能技术的持续改进可能会增强它们在健康信息传播中的作用.
更多相关视频
07:44Evaluation of Patients' Posture and Gait Profile After Lumbar Fusion Surgery by Video Rasterstereography and Treadmill Gait Analysis
Published on: March 23, 2019
17.7K
04:42Treating Low Back Pain in Failed Back Surgery Patients with Multicolumn-lead Spinal Cord Stimulation
Published on: June 26, 2018
14.5K
