人工智能聊天机器人在回答与眼科瘤学有关的问题:DeepSeek v3,ChatGPT-4o和Gemini 2.0之间的比较研究
Deepsekhar Das1, Atindra Narayan2, Varsha Mishra3
1Ophthalmology, All India Institute of Medical Sciences, New Delhi, New Delhi, IND.
Cureus
|September 24, 2025
概括
人工智能 (AI) 聊天机器人在眼科瘤学中表现出准确性,但缺乏完整性和临床适用性. 聊天GPT-4o提供了最平衡的性能,但专家监督对于安全使用至关重要.
科学领域:
- 眼科医生 眼科 眼科
- 在瘤学瘤学.
- 人工智能的人工智能
背景情况:
- 人工智能聊天机器人在医疗保健中越来越多地用于信息和决策支持.
- 它们在眼科瘤学等专业领域的可靠性在很大程度上没有得到评估.
研究的目的:
- 评估AI聊天机器人 (ChatGPT-4o,DeepSeek v3,Gemini 2.0) 在眼科瘤学查询中的准确性,完整性,可读性和临床实用性.
- 评估它们在印度医疗保健环境中的适用性.
主要方法:
- 一个横截面的观察性研究,涉及五个标准化的临床问题,眼部恶性瘤.
- 来自ChatGPT-4o,DeepSeek v3和Gemini 2.0的响应被评估为正确性,完整性,可读性和适用性.
- 使用克鲁斯卡尔-瓦利斯和ANOVA测试进行统计分析.
主要成果:
- 所有的聊天机器人都有相似的正确度得分,但大多数回复是不完整的.
- DeepSeek v3是最多言的,ChatGPT-4o提供了临床上最可靠的响应.
- 对所有聊天机器人来说,观察到对印度临床实践的适用性有限.
结论:
- 人工智能聊天机器人为眼科瘤学提供准确,但往往不完整的信息.
- 聊天GPT-4o表现最平衡,但区域定制和专家监督是必不可少的.
- 当前的人工智能聊天机器人不适合在关键临床环境中无监督使用.
更多相关视频
05:47Evidence-based Knowledge Synthesis and Hypothesis Validation: Navigating Biomedical Knowledge Bases via Explainable AI and Agentic Systems
Published on: June 13, 2025
1.3K
08:58Using R, Seurat, and CellChat to Analyze a Single-Cell Transcriptomics Dataset of Mouse Skin Wound Healing
Published on: August 1, 2025
2.8K
