评估ChatGPT-4o作为多学科肉瘤瘤委员会中的决策支持工具:跨不同专业的异质表现
Tekoshin Ammo1, Vincent G J Guillaume1, Ulf Krister Hofmann2
1Department of Plastic Surgery, Hand and Reconstructive Surgery, University Hospital Rheinisch-Westfälische Technische Hochschule (RWTH) Aachen, Aachen, Germany.
Frontiers in oncology
|February 3, 2025
概括
像ChatGPT-4o这样的大型语言模型在支持肉瘤瘤板方面表现出适度的有效性. 虽然它在外科推方面强大,但它在放射瘤学和诊断方面扎,强调需要临床医生意识到AI的局限性.
科学领域:
- 在瘤学瘤学.
- 人工智能的人工智能
- 医疗决策支持 医疗决策支持
背景情况:
- 自从ChatGPT的2023年推出以来,大型语言模型 (LLM) 在医疗保健应用中获得了显著的关注.
- 本研究研究了ChatGPT-4o作为多学科肉瘤瘤委员会中的决策辅助工具的实用性.
研究的目的:
- 评估ChatGPT-4o在产生瘤病例患者瘤委员会决策方面的性能.
- 评估不同医学专业的AI驱动推的有效性.
主要方法:
- 五个现实的肉瘤患者病例被用来提示ChatGPT-4o提供治疗和诊断建议.
- 一个由专家组成的小组 (骨科外科医生,整形外科医生,放射瘤学家,放射科医生,病理学家) 评估了AI的输出.
- 评估使用了五分利克特级别,包括理解,治疗/诊断建议,后期护理,总结和整体工具有效性.
主要成果:
- 聊天GPT-4o获得了3.76.6的中等整体有效性得分.
- 对外科专业的AI建议得到了最高的分数 (平均4.48分).
- 诊断专业 (放射学/病理学) 的表现优于放射性瘤学,其表现不佳.
结论:
- 快速设计的LLM提供了最初的潜力,作为肉瘤瘤委员会中的决策支持工具.
- 聊天GPT-4o在外科推方面表现强,但在其他领域有局限性.
- 临床医生必须了解AI的好处和缺点,以成功实现临床整合.
更多相关视频
07:47Author Spotlight: 3D Scanning and Augmented Reality for Enhanced Cancer Surgery Communication
Published on: December 15, 2023
599
07:32Author Spotlight: Investigating Immune Cell Dynamics in the Tumor Microenvironment — Challenges and Innovations in Cancer Prognosis
Published on: April 12, 2024
1.2K
