评估ChatGPT在为儿科疾病提供治疗建议方面的表现
Qiuhong Wei1,2, Yanqin Wang3, Zhengxiong Yao4
1Children Nutrition Research Center Children's Hospital of Chongqing Medical University National Clinical Research Center for Child Health and Disorders Ministry of Education Key Laboratory of Child Development and Disorders China International Science and Technology Cooperation Base of Child Development and Critical Disorders Chongqing Key Laboratory of Childhood Nutrition and Health Chongqing China.
人工智能,特别是像ChatGPT这样的大型语言模型,在儿科护理中显示出希望. 这项研究发现,ChatGPT在儿科治疗建议中实现了82.2%的准确性,尽管在特定领域的错误需要注意.
科学领域:
- 医疗信息学 医疗信息学
- 医疗保健中的人工智能
- 儿科医学 儿科医学
背景情况:
- 像ChatGPT这样的人工智能 (AI) 和大型语言模型 (LLM) 正在获得医疗保健的引力.
- 虽然人工智能在医疗领域的实用性得到了探索,但它在儿科的应用却不太了解.
- 这项研究解决了对儿科临床决策支持的LLM评估的差距.
研究的目的:
- 评估ChatGPT在提供儿科疾病治疗建议方面的准确性.
- 评估ChatGPT在各种儿科疾病和问题类型中的表现.
- 确定儿科护理中LLM的优势和弱点.
主要方法:
- 聊天GPT提供了4160个临床咨询问题,涵盖了104种儿科疾病,分别是英语和中文.
- 每个问题都被重复10次,以确保答案的可靠性.
- 对治疗建议的准确性进行了统计分析.
主要成果:
- 对于儿科治疗建议,ChatGPT的整体准确率为82.2%.
- 对于常见疾病 (84.4%) 和一般建议 (83.5%) 的表现更高.
- 英语答案的准确性 (93.0%) 超过了中文答案,但在疾病定义,药物和手术治疗中出现了错误.
结论:
- 聊天GPT显示出有很大的潜力,以高准确度帮助儿科治疗建议.
- 建议谨慎乐观,因为在药物和手术指导等关键领域观察到的不准确性.
- 需要进一步的研究来完善LLMs,以便安全有效地整合到儿科患者护理中.
更多相关视频
07:20Author Spotlight: Repetitive Transcranial Magnetic Stimulation Combined with Movement Observation in Cerebral Palsy
Published on: August 9, 2024
13:44Project-Based Learning Guidelines for Health Sciences Students: An Analysis with Data Mining and Qualitative Techniques
Published on: December 9, 2022
相关概念视频
Chronic Kidney Disease III: Interprofessional Care
Clinical Trials: Overview
Chronic Pancreatitis II: Collaborative Care
Assessment:
