在PubMed数据库中对牙科植入物学主题进行系统搜索和选择的手册和聊天GPT深度研究进行比较
Bulcsú Bencze1, Alwin Sokolowski2, Jae-Hyun Lee3
1Department of Prosthodontics, Semmelweis University, Budapest, Hungary.
International journal of dentistry
|October 22, 2025
概括
像ChatGPT这样的人工智能 (AI) 工具对科学文献评论有希望,但缺乏系统搜索的可靠性. 人类监督对于牙科植入物学中准确的研究合成至关重要.
科学领域:
- 牙科植入物学 牙科植入物学
- 科学研究中的人工智能 (AI)
背景情况:
- 牙科植入物学正在迅速发展,在诊断,规划和手术中集成人工智能.
- 聊天GPT的深度研究功能为人工智能辅助的系统审查提供了潜力,但其与手工方法相比的有效性尚未研究.
研究的目的:
- 评估ChatGPT的深度研究工具与手动方法相比在牙科植入学中进行系统审查的有效性.
主要方法:
- 进行了一项系统性审查,比较使用ChatGPT 4.1的深度研究工具和两名审查员手动搜索的PubMed搜索.
- 在2020年至2025年间发表的研究中使用了相同的关键字和布尔运算符.
主要成果:
- 手动搜索产生了23篇相关文章,而ChatGPT检索了11篇,包括不存在的参考文献和缺失的关键研究.
- 聊天GPT显示高特异性 (98%),但低灵敏度 (47.8%),与手动搜索结果显著不同.
结论:
- 聊天GPT的深度研究功能可以协助文献搜索和综合,但不是手动系统审查的可靠替代品.
- 可靠性和敏感性的局限性需要人类监督和科学研究中人工智能使用的透明报告.


