评估通过人工智能提供的关于远距离双肩肌修复手术的信息
Suhasini Gupta1, Brett D Haislup2, Ryan A Hoffman2
1T.H. Chan School of Medicine University of Massachusetts Worcester Massachusetts USA.
Journal of experimental orthopaedics
|May 20, 2025
概括
人工智能 (AI) 模型ChatGPT提供了关于远距离双肩修复手术的高质量信息,但其准确性和可靠性较低. 可读性几乎达到大学毕业生水平,这给寻求外科信息的普通患者带来了挑战.
科学领域:
- 整形外科手术 整形外科手术
- 人工智能在医学中的应用
- 医疗信息质量 医疗信息质量
背景情况:
- 患者越来越多地使用在线资源获取医疗信息.
- 像ChatGPT这样的人工智能 (AI) 聊天机器人正在成为潜在的信息来源.
- 评估人工智能生成的医疗内容的可靠性和可读性至关重要.
研究的目的:
- 分析ChatGPT关于远距离双肩肌修复手术的信息的质量,准确性,可靠性和可读性.
- 将人工智能生成的患者信息与已建立的医疗基准进行评估.
主要方法:
- 聊天GPT 3.5 回答了 27 个关于远距离双肩修复手术的患者问题.
- 答案根据罗斯威尔标准 (事实,政策,价值) 进行分类.
- 使用DISCERN,JAMA基准标准,弗莱什-金凯德阅读易度得分 (FRES) 和弗莱什-金凯德等级水平 (FKGL) 进行评估.
主要成果:
- 在各个类别中,DISCERN的分数表明质量"好" (59-61).
- 在所有类别中,JAMA基准标准得分为0 (最低).
- FRES分数表明难以阅读 (21.77-24.49),而FKGL分数约为15 (大学毕业生水平).
结论:
- 与未引用的在线资源相比,ChatGPT提供了一个"优质"的远距离双肩修复信息来源.
- 然而,准确性和可靠性很低,可读性很高 (大学毕业生水平).
- 医生应该建议患者了解ChatGPT对远距离双肩修复信息的局限性.


