评估ChatGPT和Google BARD在对眼镜造形患者查询的准确性:对人工智能与人类智能的比较研究
Eman M Al-Sharif1,2, Rafaella C Penteado1, Nahia Dib El Jalbout1
1Division of Oculofacial Plastic and Reconstructive Surgery, Viterbi Family Department of Ophthalmology, UC San Diego Shiley Eye Institute, La Jolla, California, U.S.A.
Ophthalmic plastic and reconstructive surgery
|January 12, 2024
概括
人工智能聊天机器人在回答眼膜问题方面表现有前途,ChatGPT在准确性和同理心方面普遍优于BARD. 医生监督对于患者安全和复杂病例至关重要.
科学领域:
- 眼科医生 眼科 眼科
- 人工智能的人工智能
- 医疗信息学 医疗信息学
背景情况:
- 人工智能 (AI) 越来越多地被用于医疗保健应用.
- 聊天机器人提供了患者教育和支持的潜力,在特殊的医疗领域,如 oculoplastics.
研究的目的:
- 评估和比较两个人工智能平台 (ChatGPT-3.5和BARD) 对与眼膜相关的患者问题所提供的答案的准确性.
- 评估人工智能生成的响应的同理心,长度和可读性.
主要方法:
- 收集了112个眼皮塑料患者的问题,并重新表述了它们.
- 问题被输入到ChatGPT-3.5和BARD,使用一个特定的提示.
- 答案由四名眼科专家对准确性,全面性,同理心,长度和可读性进行了评估.
主要成果:
- 聊天GPT提供全面的答案更频繁 (71.4%) 比BARD (53.1%).
- 与BARD (13.2%) 相比,ChatGPT表现出更高的同情心 (48.9%).
- 聊天GPT在回答有关术后愈合,眼部疾病,药物和眼问题的问题方面表现出色,而BARD在与眼有关的问题上表现更好.
结论:
- 人工智能聊天机器人显示出增强患者教育和对眼膜塑料的支持的潜力.
- 持续开发人工智能可能有助于医生和改善患者护理,可能减少外科医生倦怠.
- 医生监督对于确保准确性和管理复杂病例,保持最高标准的护理至关重要.


