相关实验视频
Updated: Aug 10, 2026

10:41
VisualEyes: A Modular Software System for Oculomotor Experimentation
Published on: March 25, 2011
12.8K
开发和评估Aeyeconsult:一个新的眼科聊天机器人利用经过验证的教科书知识和GPT-4
Maxwell B Singer1, Julia J Fu2, Jessica Chow1
1Department of Ophthalmology and Visual Science, Yale School of Medicine, New Haven, Connecticut.
Journal of surgical education
|December 22, 2023
概括
一个新的AI聊天机器人,Aeyeconsult,使用经过验证的眼科教科书,比ChatGPT-4更准确地回答眼科问题. 这种方法确保可靠,引用来源的响应,以改善临床决策.
科学领域:
- 眼科医生 眼科 眼科
- 人工智能的人工智能
- 医疗信息学 医疗信息学
背景情况:
- 像ChatGPT这样的大型语言模型 (LLM) 在眼科中表现有前途,但受到未经验证的培训数据和缺乏引用来源的限制.
- 现有的LLM可能会提供不准确或不可靠的信息,在临床环境中构成风险.
- 眼科中需要可靠的AI工具,提供准确,可验证的信息.
研究的目的:
- 开发一种新的生成AI聊天机器人Aeyeconsult,用于回答眼科相关的问题.
- 确保聊天机器人仅使用经过验证的眼科教科书作为数据来源.
- 在聊天机器人的响应中实现源引用,以提高可信度.
主要方法:
- Aeyeconsult使用GPT-4,LangChain和Pinecone开发,将眼科教科书处理成嵌入式,存储在Pinecone中.
- 用户查询被转换为嵌入式,与数据库相比,GPT-4生成了响应.
- 在OphthoQuestions.com.com的260个问题中,Aeyeconsult和ChatGPT-4都得到了评估.
主要成果:
- 在OKAP数据集上,Aeyeconsult实现了83.4%的准确性,明显超过了ChatGPT-4的69.2% (p=0.0118).
- 与ChatGPT-4相比,Aeyeconsult显示"没有答案"和"多个答案"的情况较少.
- 眼科咨询在通用医学方面表现出色 (准确率为96.2%),在临床光学方面表现优于ChatGPT-4 (68.1%与45.5%相比).
结论:
- 开发的方法,使用经过验证的教科书和提供引文,减轻了关于准确性和可信度的LLM限制.
- 在回答眼科风格问题时,Aeyeconsult证明比ChatGPT-4更准确,证明了精选数据方法的有效性.
- 这个人工智能聊天机器人为眼科教育和潜在的临床支持提供了更可靠的工具.

