评估人工智能程序在儿科眼科和的能力,并比较它们的相对优势
Eyupcan Sensoy1, Mehmet Citirik1
1Department of Ophthalmology, Ankara Etlik City Hospital, Ankara, Turkey.
Romanian journal of ophthalmology
|January 19, 2024
概括
像ChatGPT,Bing和Bard这样的人工智能聊天机器人在儿科眼科和眼知识方面显示出不同的准确性. 虽然它们的信息是可访问的,但由于潜在的不准确性,它们的信息需要仔细验证.
科学领域:
- 眼科医生 眼科 眼科
- 人工智能的人工智能
- 儿科医学 儿科医学
背景情况:
- 人工智能 (AI) 工具越来越多地用于医疗信息检索.
- 在儿童眼科等专业领域评估AI的准确性至关重要.
研究的目的:
- 评估ChatGPT,Bing和Bard在儿科眼科和眼症方面的知识.
- 为了比较这些AI程序在医疗领域的优缺点.
主要方法:
- 44个关于儿科眼科和眼的问题被提出给ChatGPT,Bing和Bard.
- 记录和统计分析了答案的准确性.
主要成果:
- 巴德获得了最高的准确率 (72.7%),其次是Bing (70.5%) 和ChatGPT (59.1%).
- 在三个AI程序 (p=0.343) 之间的准确率中没有发现统计学上显著的差异.
结论:
- 目前的人工智能聊天机器人可以提供有关儿科眼科医生和偏的信息.
- 人工智能生成的医疗信息的准确性是可变的,需要用户进行批判性评估.


