评估一个大型语言模型在整形手术诊所的协助能力
Travis Kotzur1, Aaron Singh1, John Parker1
1UT Health San Antonio, TX, USA.
概括
像ChatGPT这样的人工智能 (AI) 工具在骨科中显示出有前途的临床助理,准确诊断大多数手部疾病,但在复杂的病例中扎. 它在患者管理和治疗建议中的实用性是可变的.
科学领域:
- 整形外科手术 整形外科手术
- 医疗人工智能 医疗人工智能
- 临床决策支持 临床决策支持
背景情况:
- 人工智能 (AI),以ChatGPT等大型语言模型为例,为医疗应用提供了变革性的潜力.
- 这项研究调查了ChatGPT作为骨科手部诊所环境中的临床助理的疗效.
研究的目的:
- 评估ChatGPT在治疗手部病理方面的诊断准确性和临床实用性.
- 评估ChatGPT在生成骨科手部疾病的差异诊断,治疗计划和治疗建议方面的表现.
主要方法:
- 由骨科专家开发和审查了手部病理的九个临床细节.
- 聊天GPT处理这些图片,以产生差异诊断,工作策略和治疗选择.
- 用5分利克尔特尺度评估了诊断准确性和整体临床实用性.
主要成果:
- 聊天GPT的诊断准确率达到了78% (9例中有7例).
- 性能不同,复杂或不常见病理的可靠性较低,无法检测有故意有缺陷的病例.
- 利克特等级分数表明诊断,检查和治疗建议 (范围从3.4到4.4) 的效用中等至高.
结论:
- 聊天GPT在诊断常见的手病方面表现出能力,但对于复杂的病例需要进一步改进.
- 虽然它在建议治疗方面有效,但它对不常见病理和错误检测的诊断准确性需要改进.
- 变量实用性强调了需要在临床实践中仔细整合和监督AI工具的必要性.


