一项对人工智能程序在诊断眼科病理和眼内瘤方面的知识水平进行比较研究,评估了它们的优越性和潜在实用性
Eyupcan Sensoy1, Mehmet Citirik2
1Ankara Etlik City Hospital, Ankara, Turkey. dreyupcansensoy@yahoo.com.
International ophthalmology
|October 25, 2023
概括
像ChatGPT,Bing和Bard这样的人工智能聊天机器人显示了眼科病理学的不同知识. 虽然Bard表现最好,但没有聊天机器人表现出优越性,强调需要仔细审查人工智能生成的医疗信息.
科学领域:
- 眼科医生 眼科 眼科
- 人工智能的人工智能
- 医疗信息学 医疗信息学
背景情况:
- 人工智能 (AI) 聊天机器人越来越多地用于信息检索.
- 它们在眼科等专业医疗领域的准确性需要评估.
- 这项研究评估了人工智能对眼科病理和眼内瘤的知识.
研究的目的:
- 评估ChatGPT,Bing和Bard关于眼科病理和眼内瘤的知识.
- 评估这些AI聊天机器人的医疗信息的可用性.
- 为了确定任何人工智能聊天机器人是否在这个领域表现出优越性.
主要方法:
- 来自美国眼科学院2022-2023年基础和临床科学课程的36个问题被使用.
- 每个问题都向ChatGPT,Bing和Bard提出.
- 答案被分类为正确或不正确,并进行统计分析.
主要成果:
- 巴德获得了最高的正确答案率69.4%,其次是Bing63.9%和ChatGPT58.6%.
- 在三个人工智能聊天机器人 (p=0.705) 之间的正确答案率中没有发现统计学上显著的差异.
结论:
- 人工智能聊天机器人可以作为关于眼科病理和眼内瘤信息的资源.
- 用户必须意识到,AI聊天机器人并不总是提供正确的答案.
- 对人工智能生成的医疗信息进行批判性评估是必不可少的.


