相关实验视频
Updated: Jun 19, 2026

08:58
Artificial Intelligence Approaches to Assessing Primary Cilia
Published on: May 1, 2021
4.1K
评估人工智能产生的纤维肌痛信息:超越作
Mert Zure1, Ahmet Kıvanç Menekşeoğlu2
1Department of Physical Medicine and Rehabilitation, University of Health Sciences İstanbul Kanuni Sultan Süleyman Training and Research Hospital, İstanbul, Türkiye.
Archives of rheumatology
|September 18, 2025
概括
人工智能 (AI) 聊天机器人提供可访问的健康信息,但其准确性各不相同. 双子座,Copilot和Perplexity AI显示出更好的质量,尽管所有这些都需要用户谨慎和临床医生的指导来获得纤维肌痛信息.
科学领域:
- 医疗信息学 医疗信息学
- 医疗保健中的人工智能
- 获取患者信息 获取信息
背景情况:
- 人们越来越依赖人工智能聊天机器人来寻找健康信息.
- 关于人工智能产生的健康内容的准确性和可用性的不确定性.
- 需要评估AI聊天机器人的性能,以针对特定的疾病,如纤维肌痛.
研究的目的:
- 评估AI聊天机器人对常见纤维肌痛查询的响应的质量,全面性和可读性.
- 为了比较六个领先的人工智能聊天机器人的性能:ChatGPT-3.5,ChatGPT-4o,Copilot AI,Perplexity AI,Gemini AI和ChatSonic AI.
- 确定AI聊天机器人生成的健康信息的局限性和改进领域.
主要方法:
- 从谷歌趋势中检索了与纤维肌痛相关的前10个查询.
- 单独查询了6个AI聊天机器人,产生了60个响应.
- 通过两个独立审稿人对内容质量,准确性,可读性和遵守指南进行了定性和定量评估.
主要成果:
- 双子AI得分最高 (40.5 ± 5),但质量仍然很低;ChatGPT-3.5得分最低 (20.6 ± 4.5).
- 对Copilot,Gemini和Perplexity的理解能力中等;对于ChatGPT-3.5.5的理解能力最低.
- 在所有聊天机器人中,可操作性弱,错误信息风险中等,以及大学级可读性复杂性.
结论:
- 人工智能聊天机器人为纤维肌痛提供可访问但质量可变的健康信息.
- 双子座,副驾驶员和困惑的人工智能表现相对更好.
- 引用问题,可读性挑战和错误信息风险需要对使用人工智能健康工具的患者进行批判性评估和临床指导.

