在骨科诊断中评估ChatGPT,Gemini和其他大型语言模型 (LLM):一项前性临床研究
Stefano Pagano1, Luigi Strumolo2, Katrin Michalk1
1Department of Orthopaedic Surgery, University of Regensburg, Asklepios Klinikum, Bad Abbach, Germany.
Computational and structural biotechnology journal
|January 24, 2025
概括
大型语言模型 (LLM) 在诊断骨关节炎方面表现有前途. GPT-4o使用患者问卷实现了高灵敏度,但医疗监督对于准确的诊断至关重要.
科学领域:
- 人工智能在医学中的应用
- 医学诊断 医学诊断 医学诊断
- 自然语言处理自然语言处理.
背景情况:
- 大型语言模型 (LLM) 正在成为医疗保健中的潜在工具.
- 这项研究调查了部或膝盖骨关节炎 (OA) 的LLM诊断能力.
- 使用患者报告的数据,不包括事先的医疗咨询.
研究的目的:
- 评估各种LLM在检测关节或膝关节骨关节炎的诊断灵敏度.
- 为了评估LLM的表现,只使用来自问卷的患者报告的数据.
- 将LLM诊断与专家骨科临床医师诊断进行比较.
主要方法:
- 一项前性观察性研究,涉及115名骨科诊所的患者.
- 患者填写了一份关于症状,病史和人口统计数据的纸质问卷.
- 针对临床医生的诊断,分析了五种LLM (包括ChatGPT,Gemini,Llama,Gemma 2,Mistral-Nemo).
主要成果:
- GPT-4o表现出最高的诊断灵敏度为92.3%,超过其他LLMs.
- 患者症状报告的完整性强烈预测了GPT-4o准确性.
- 模型间的协议有所不同,GPT-4版本显示中度协议和Llama-3.1更低的准确性.
结论:
- 根据患者问卷,GPT-4o在诊断OA方面表现出高准确性和一致性.
- LLM可以作为补充诊断工具,但需要医疗监督.
- 需要进一步的研究来提高LLM在医疗保健中的诊断效用.
关键词:
医疗保健中的人工智能聊天GPT 聊天GPT 聊天诊断的敏感性 诊断的敏感性在 GPT-4o 中.双子座是一个双子座.杰玛2 杰玛2 在线观看关节骨关节炎是一种关节炎.膝关节骨关节炎是一种关节炎.大型语言模型 (LLM)拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛拉玛"米斯特拉尔·尼莫"号肌肉骨系统疾病 肌肉骨系统疾病骨科诊断 骨科诊断 骨科诊断 骨科诊断患者报告的数据

