以人工智能为基础的语言模型 (ChatGPT,YouChat,Gemini和Perplexity AI) 在英语和西班牙语中提供的心房患者信息的可靠性和可读性评估
Emilio Jose Juan Juan-Guardela1,2,3, Jesús Andrés Beltrán-España1,2,3, María Paula Ravagli-Baquero4
1Department of Internal Medicine, Pontificia Universidad Javeriana, Bogota, Colombia.
Clinical Medicine Insights. Cardiology
|November 3, 2025
概括
人工智能 (AI) 模型对心房动 (AF) 信息有希望,但需要提高可读性. 聊天GPT和困惑是最可靠的,尽管内容复杂性需要解决患者的理解.
科学领域:
- 医疗信息学 医疗信息学
- 医疗保健中的人工智能
- 患者教育 患者教育
背景情况:
- 心房动 (AF) 是一种常见的心律失常,影响患者的健康.
- 人工智能语言模型为获取医疗信息提供了新的途径.
- 人工智能产生的健康内容的准确性和可理解性存在担忧.
研究的目的:
- 评估AI语言模型对AF患者信息的可靠性和可读性.
- 为了比较ChatGPT,YouChat,Gemini和Perplexity在英语和西班牙语中的性能.
主要方法:
- 一项横截面研究评估了人工智能对30个标准化的英语和西班牙语AF问题的反应.
- 两个独立的审查员使用标准化工具评估了响应质量.
- 使用弗莱什-西格里斯特公式测量可读性.
主要成果:
- 聊天GPT在两种语言中都显示出高度的互评级协议.
- 困惑在英语表现最好 (93%),而ChatGPT在西班牙语表现最好 (80%的完整响应).
- 在模型之间发现了可读性的显著差异,ChatGPT的内容在两种语言中都是具有挑战性的.
结论:
- 聊天GPT和困惑是AF信息的最可靠的AI模型.
- 人工智能产生的医疗内容的可读性仍然是一个重大挑战.
- 需要改进,以提高AI健康信息的准确性和可访问性.


