对ChatGPT版本进行比较,以告知旋转手腕受伤的患者
Ali Eray Günay1, Alper Özer1, Alparslan Yazıcı2
1Department of Orthopedics and Traumatology, Kayseri City Training and Research Hospital, Kayseri, Turkey.
JSES international
|September 16, 2024
概括
聊天生成预训练变压器 (ChatGPT) 为旋转手套修复患者提供了高质量的信息,但缺乏引用. 聊天GPT 3.5 和 4.0 都难以阅读,而 4.0 版本更易于阅读.
科学领域:
- 人工智能在医学中的应用
- 医疗信息传播 医疗信息传播
- 手术患者教育 在手术患者教育.
背景情况:
- 评估ChatGPT作为旋转手套修复的患者信息资源.
- 评估ChatGPT 3.5和4.0之间的差异,以了解患者.
- 专注于术前患者指导的信息内容和可读性.
研究的目的:
- 为了确定ChatGPT是否可以推为患者提供有关旋转手套修复的信息.
- 为了比较ChatGPT 3.5与ChatGPT 4.0.0之间的信息质量和可读性.
- 评估人工智能产生的医疗建议的可靠性和可访问性.
主要方法:
- 对ChatGPT 3.5和4.0.0.提出的13个常见的旋转部疾病问题.
- 三位经验丰富的旋转手术师在2023年8月回答的问题.
- 使用JAMA和DISCERN分数分析答案质量和可读性.
主要成果:
- 两个ChatGPT版本均获得了平均JAMA分数为0.
- 平均DISCERN分数为61.6,版本之间有很强的相关性.
- 聊天GPT 4.0显示出比聊天GPT 3.5更高的可读性,尽管两者都难以阅读.
结论:
- 聊天GPT提供高质量的信息,但缺乏关键的引用,影响可靠性.
- 虽然ChatGPT 4.0更易于阅读,但这两种AI版本都对患者的理解提出了挑战.
- 需要进一步开发,以提高患者教育人工智能工具的可靠性和可读性.


