字节诊断:比较谷歌和Chat的诊断准确性GPT 3.5作为教育支持工具
Guilherme R Guimaraes1, Ricardo G Figueiredo1, Caroline Santos Silva1
1Programa de Pós-Graduação em Saúde Coletiva, Universidade Estadual de Feira de Santana (UEFS), Feira de Santana 44.036-900, Brazil.
概括
聊天GPT 3.5显示出比谷歌更高的诊断准确度,对于泌尿病的情况. 虽然对常见病例有效,但对罕见疾病的准确性有限,这凸显了需要进一步评估AI诊断工具的需要.
科学领域:
- 数字健康数字健康
- 人工智能在医学中的应用
- 医学诊断 医学诊断 医学诊断
背景情况:
- 数字技术在医疗保健中的整合加速了,特别是在COVID-19后.
- 人工智能工具作为医疗保健支持的诊断准确性仍然是调查的关键领域.
- 本研究评估了两个可访问的互联网搜索工具:谷歌和ChatGPT 3.5.5.
研究的目的:
- 为了比较谷歌和ChatGPT 3.5.5的诊断准确度.
- 为了评估在常见和罕见的泌尿病条件的表现.
- 提供关于人工智能在临床决策支持中的实用性的见解.
主要方法:
- 评估了60个泌尿病例,分为流行和不寻常的情况.
- 基于EAU和UpToDate指南的流行病例;来自"泌尿病例报告" (2022-2023) 的异常病例.
- 专家对诊断的盲目和随机评估是"正确"",可能差异"或"不正确".
主要成果:
- 聊天GPT 3.5 在常见的泌尿病状况中获得了86.6%的准确性,明显超过谷歌 (53.3%).
- 对于罕见的疾病,谷歌没有提供正确的诊断,而ChatGPT 3.5实现了16.6%的准确性.
- 聊天GPT 3.5在确定常见和罕见泌尿病例的正确和差异诊断方面表现出卓越的性能.
结论:
- 与谷歌相比,ChatGPT 3.5对泌尿病的诊断准确度更高.
- 人工智能工具在常见诊断方面表现出令人满意的准确性,但在罕见疾病方面存在局限性.
- 需要进一步的研究来优化AI诊断能力在专业医疗领域.
更多相关视频
09:00Author Spotlight: Validation of SICOLE-R for Assessing Cognitive and Reading Skills in Spanish-Speaking Children and Its Role in Personalized Education
Published on: August 16, 2024
753
04:19A Computer-Based Platform for Aiding Clinicians in Eating Disorder Analysis and Diagnosis
Published on: May 10, 2022
3.8K
