对三种聊天机器人对儿科初级夜间尿尿症的反应进行了比较分析
Asya Eylem Boztas1, Esra Ensari2
1Health and Science University Dr. Behcet Uz Pediatric Diseases and Surgery Training and Research Hospital, Department of Pediatric Surgery, Kultur mh. Dr.Mustafa Enver Bey cd. No:32 D:10 Konak, Izmir, Turkey.
Journal of pediatric urology
|May 12, 2025
概括
与Gemini和Copilot相比,ChatGPT-4o在回答儿科夜间尿尿问题方面表现出卓越的准确性和可重复性. 虽然对于简单的查询有用,但人工智能工具应该补充,而不是取代专业的医疗建议.
科学领域:
- 人工智能在医学中的应用
- 儿科泌尿外科 儿科泌尿外科
- 医疗信息系统 医疗信息系统
背景情况:
- 主要夜间尿泡是常见的儿科疾病.
- 准确的信息对于患者和家长的理解至关重要.
- 评估AI聊天机器人的医疗查询准确度至关重要.
研究的目的:
- 为了评估ChatGPT-4o,Gemini和Copilot响应的准确性和可重复性.
- 为了解决有关儿科初级夜间尿尿失常见问题的问题.
- 为了比较领先的人工智能聊天机器人在特定医疗领域的表现.
主要方法:
- 关于儿童夜间尿尿失禁的40个常见问题被两次向ChatGPT-4o,Gemini和Copilot提出.
- 答案由儿科外科医生和科医生独立评分.
- 评分标准包括全面/正确,不完整/部分正确,混合和不准确/不相关的答案.
主要成果:
- 聊天GPT-4o获得了最高的准确率92.5%,其次是Gemini (50%) 和Copilot (45%).
- 聊天GPT-4o的可复制率为85%,双子座的77.5%,Copilot的70%.
- 副驾驶提供了2.5%的完全不准确/不相关的答案率.
结论:
- 聊天GPT-4o是最有效的AI聊天机器人,用于准确响应夜间尿尿.
- 人工智能聊天机器人可以帮助患者和家长回答简单的医疗问题.
- 人工智能产生的信息应该始终与医疗保健专业人员进行验证.


