评估和比较当前的人工智能程序对视网膜/视疾病和治疗方法的知识水平
Eyupcan Sensoy1, Mehmet Citirik1
1Department of Ophthalmology, Ankara Etlik City Hospital, Ankara, Turkey.
Journal of current ophthalmology
|November 18, 2024
概括
与ChatGPT和Bard相比,Bing AI在回答有关视网膜和玻璃体疾病的问题上表现出更高的准确性,尽管这三个聊天机器人之间没有发现显著差异.
科学领域:
- 眼科医生 眼科 眼科
- 人工智能在医学中的应用
- 医疗信息检索 医疗信息检索
背景情况:
- 人工智能 (AI) 聊天机器人越来越多地用于访问健康信息.
- 评估人工智能生成的医疗信息的准确性对于患者安全和临床决策至关重要.
- 关于人工智能聊天机器人在视网膜和玻璃体疾病等专业医疗主题上的表现,存在特定的知识差距.
研究的目的:
- 评估ChatGPT,Bard和Bing AI聊天机器人关于视网膜和玻璃体疾病的反应的准确性.
- 为了比较知识水平,并确定这些AI聊天机器人在眼科中的任何优势.
- 评估视网膜和玻璃体疾病的治疗方法,如AI所提出的.
主要方法:
- 制定了一套46个多选题,重点关注视网膜和玻璃体疾病及其治疗方法.
- 这些问题是向三个著名的AI聊天机器人提出的:ChatGPT,Bard和Bing.
- 记录和分析了每个聊天机器人提供的答案的准确性.
主要成果:
- Bing AI 聊天机器人实现了最高的准确率,正确回答了 76.1% 的问题.
- 聊天GPT和Bard AI聊天机器人正确回答了60.9%的问题.
- 统计分析显示,三种人工智能聊天机器人之间的准确率没有显著差异 (P = 0.206).
结论:
- 人工智能聊天机器人可以作为有关视网膜和玻璃体疾病和治疗的信息来源.
- 用户必须保持谨慎,因为AI提供的医疗信息的准确性并不能保证.
- 需要进一步的研究来验证人工智能聊天机器人对复杂的医疗查询的可靠性.


