从提示到实践:评估聊天GPT,双子座和格洛克与塑料外科医生在当地片决策中的对比
Gianluca Marcaccini1, Luca Corradini1, Omar Shadid2
1Plastic Surgery Unit, Department of Medicine, Surgery and Neuroscience, University of Siena, 53100 Siena, Italy.
Diagnostics (Basel, Switzerland)
|October 29, 2025
概括
生成型人工智能 (AI) 在帮助重建性手术决策方面表现有前途. 聊天GPT-5在选择皮肤癌缺陷的局部板方面表现出最高的可靠性,优于其他AI模型.
科学领域:
- 整形外科 整形外科 整形外科
- 人工智能的人工智能
- 医疗成像医学成像
背景情况:
- 当地片对于在癌症手术后重建皮肤缺陷至关重要.
- 外科医生的经验会影响局部片的选择.
- 生成性人工智能是一种潜在的决策支持工具,其临床实用性不确定.
研究的目的:
- 评估三个生成性AI平台在瘤性皮肤缺陷的局部片选择中的性能.
- 为了比较人工智能生成的推与专家外科医生的共识.
主要方法:
- 三个人工智能平台 (ChatGPT-5,Grok,Gemini) 使用皮肤病变的术前图像进行了测试.
- 人工智能模型描述了病变特征,并推了局部片.
- 结果与经验丰富的整形外科医生的共识进行了比较.
主要成果:
- 聊天GPT-5在片选择和精确的损伤大小描述方面与外科医生完全一致.
- 格罗克表现中等,在组织平面识别方面表现更好,而不是尺寸.
- 双子座在解剖部位,组织参与和板建议方面不一致.
结论:
- 生成型人工智能可以从临床图像中协助重建推理,但可靠性各不相同.
- 在这项研究中,ChatGPT-5成为本地板规划中最可靠的AI.
- 需要对标准化成像进行进一步的研究,以确认其临床适用性和安全性.


