当前人工智能大型语言模型的实用性和比较性能,作为美容手术中的术后医疗支持聊天机器人
Aesthetic surgery journal
|February 6, 2024
概括
在用于整形外科手术的AI驱动的术后医疗支持聊天机器人中,ChatGPT显著超过了谷歌Bard. 这项研究强调了ChatGPT作为患者护理应用程序的优越大语言模型 (LLM).
科学领域:
- 人工智能在医学中的应用
- 整形外科的应用 整形外科的应用
- 自然语言处理自然语言处理.
背景情况:
- 大型语言模型 (LLM) 正在改变整形外科的AI可访问性.
- 患者可访问的AI工具为医疗支持提供了新的途径.
研究的目的:
- 为了比较ChatGPT和Google Bard作为AI术后医疗支持聊天机器人的性能.
- 评估LLM在诊断和管理模拟整形手术并发症方面的准确性.
主要方法:
- 开发了22个经过专家验证的,模拟的术后乳腺整形手术案例.
- 评估未经修改的ChatGPT和Bard反应,以确定诊断,处置和红旗识别的准确性.
- 并发症的延迟和紧迫性各不相同.
主要成果:
- 在所有指标上,ChatGPT表现优越 (66%),而Bard (55%) 的表现优越 (P < .05).
- 在识别最可能的诊断 (91% vs 68%) 和红旗症状 (79% vs 54%) 中,ChatGPT 实现了更高的准确性.
- 这两种模型都显示出局限性,指导了未来的AI改进.
结论:
- 聊天GPT是开发AI术后医疗支持聊天机器人的首选LLM在美容手术.
- 需要进一步改进以解决性能限制,并促进在患者护理中采用人工智能.


