大型语言模型对良性前列腺增生症的表现常见问题
YuNing Zhang1,2, Yijie Dong1,2, Zihan Mei1,2
1Department of Ultrasound, Ruijin Hospital, Shanghai Jiaotong University School of Medicine, Shanghai, China.
The Prostate
|April 1, 2024
概括
像ChatGPT和New Bing Chat这样的大型语言模型 (LLM) 提供了关于良性前列腺增生症 (BPH) 的准确和可重现的信息. 这些人工智能工具可以帮助改善BPH患者的健康素养.
科学领域:
- 泌尿器科 泌尿器科 泌尿器科 泌尿器科
- 医疗保健中的人工智能
- 医疗信息学 医疗信息学
背景情况:
- 良性前列腺增生症 (BPH) 是一种普遍的疾病,但患者难以获得可靠的信息.
- 评估BPH信息的大型语言模型 (LLM) 的准确性和可重复性至关重要.
- 这项研究比较了ChatGPT-3.5,ChatGPT-4和新Bing聊天对BPH常见问题的反应.
研究的目的:
- 评估LLM生成的关于良性前列腺增生 (BPH) 常见问题的答案的准确性.
- 为了比较不同LLM (ChatGPT-3.5,ChatGPT-4,New Bing Chat) 响应的可重现性.
- 确定LLM作为BPH患者教育和健康素养资源的适用性.
主要方法:
- 开发了一个由45个BPH相关问题组成的问卷,涵盖基础知识和专业知识.
- 使用ChatGPT-3.5,ChatGPT-4和新Bing聊天生成了回复.
- 泌尿科医生评估了反应的准确性 (全面,充分,混合,不正确) 和可重现性.
主要成果:
- 所有评估的LLM都表现出高准确度,比率在86.7%至100%之间,没有统计学上显著的差异.
- 基本和专业BPH知识的LLM准确性是可比的,差异很小 (<3.5%).
- 在所有LLM中观察到高可重复性,从93.3%到97.8%不等.
结论:
- 聊天GPT-3.5,聊天GPT-4和新Bing聊天提供准确和可重现的关于良性前列腺增生 (BPH) 的信息.
- 这些LLM可以作为有价值的工具,以提高患者对BPH的理解和健康素养.
- 律师可以支持医疗保健专业人员向患者提供可靠的BPH信息.
更多相关视频
03:14Augmenting Large Language Models via Vector Embeddings to Improve Domain-Specific Responsiveness
Published on: December 6, 2024
554
08:38Renal Capsule Xenografting and Subcutaneous Pellet Implantation for the Evaluation of Prostate Carcinogenesis and Benign Prostatic Hyperplasia
Published on: August 28, 2013
25.2K
