概括
这项研究发现,虽然知情同意表格提供了最高的医疗准确性,但像ChatGPT-4这样的大型语言模型 (LLM) 为寻求有关美容手术风险信息的患者提供了卓越的可读性和清晰度.
科学领域:
- 医疗信息学 医疗信息学
- 医疗保健中的人工智能
- 外科教育的外科教育
背景情况:
- 人工智能 (AI) 在医学上显示出显著的前景,快速的进步表明它在临床实践中未来的重要作用.
- 评估人工智能生成的医疗信息对于安全的患者沟通至关重要.
研究的目的:
- 为了比较医疗知识的可读性,清晰度和精度,从三个大型语言模型 (LLM) 与知情同意表格进行了比较.
- 对14种常见的美容外科手术程序评估人工智能生成的内容.
主要方法:
- 系统评估ChatGPT-4,Gemini和Copilot,使用14个关于美容手术风险的提示.
- 对LLM答案与美国塑料外科医生协会 (ASPS) 知情同意表格的风险部分进行比较.
主要成果:
- 知情同意表格显示了最高的医学知识准确性,而LLM生成的内容和知情同意表格在可读性和清晰度方面得分最高.
- 包括LLM内容在内的程序特定的知情同意表格获得了最低的医学知识准确度分数.
- 外科医生更喜欢使用ChatGPT-4来处理患者材料,因为外科医生认为它具有更高的精度和信息.
结论:
- 医生更喜欢ChatGPT-4用于面向患者的材料,因为它与其他AI工具相比,具有精确和全面的医学知识.
- 遵守ASPS关于签署知情同意的建议对于预防并发症和确保充分的患者信息至关重要.


