人工智能可以教育病人吗? 聊天GPT和DeepSeek模型在阴囊损伤中的比较分析
Bahri Bozgeyik1, Erman Öğümsöğütlü2
1Department of Orthopaedics and Traumatology, Faculty of Medicine, Gaziantep University, Gaziantep 27000, Turkey.
Healthcare (Basel, Switzerland)
|November 27, 2025
概括
与ChatGPT相比,DeepSeek AI在回答患者关于阴茎损伤的问题方面表现出更高的质量,尽管这两种AI模型都提供了适合患者教育的可理解信息.
科学领域:
- 整形外科 整形外科 整形外科
- 医疗信息学 医疗信息学
- 人工智能的人工智能
背景情况:
- 阴茎损伤是常见的膝盖疾病,需要有效的患者教育,以保证治疗的坚持和康复.
- 基于人工智能 (AI) 的大型语言模型 (LLM) 在医疗保健环境中越来越多地被使用.
- 患者教育对于管理膝关节关节疾病,如阴茎损伤至关重要.
研究的目的:
- 为了比较人工智能对患者关于阴茎损伤问题的答案的质量和可读性.
- 评估ChatGPT-5和DeepSeek R1在患者关于阴茎损伤的教育中的有效性.
主要方法:
- 关于阴茎损伤的12个常见问题被提出给ChatGPT-5和DeepSeek R1.
- 整形外科医生通过评分系统和利克特尺度对答案的准确性,清晰性,全面性和一致性进行了评估.
- 使用弗莱什-金凯德阅读易度得分 (FRES) 和等级水平 (FKGL) 测量可读性.
主要成果:
- 在总体响应质量 (p=0.017) 和全面性 (p=0.005) 方面,DeepSeek R1显著超过了ChatGPT-5.
- 两种人工智能模型在准确性,清晰性或一致性方面没有发现显著差异.
- 两种AI模型都产生了高中水平可读的内容,可比性可读性得分相似.
结论:
- 聊天GPT和DeepSeek都显示出潜在的潜力,作为患者在阴茎损伤方面的教育工具.
- DeepSeek R1 显示了更高的整体内容质量,而这两种模式都提供了可访问的信息.
- 人工智能生成的患者教育材料需要进一步提高清晰度和可访问性.

