提高医疗图像分类的稳定性和可靠性,使用潜向导向扩散和嵌套组件
IEEE transactions on medical imaging
|June 30, 2025
概括
我们介绍了LaDiNE,这是一种用于医疗图像分析的新型组合学习方法. 这种方法结合了视觉变压器和扩散模型,以提高预测准确性和信心校准,提高临床应用的可靠性.
科学领域:
- 医学图像分析 医学图像分析
- 深度学习 (Deep Learning) 是一种深度学习.
- 计算机视觉 计算机视觉
背景情况:
- 医疗成像深度学习模型与现实世界的数据腐败和噪音作斗争.
- 不可靠的预测和不良的信心校准阻碍了AI在医学中的临床采用.
- 现有的方法解决了诸如强度或校准等特定问题,但缺乏统一的框架.
研究的目的:
- 开发一个新的集体学习框架,LaDiNE,用于强大可靠的医疗图像分类.
- 为了提高预测准确性和在各种图像干扰下进行信心校准.
- 为了弥合清洁数据的深度学习性能和现实世界的临床适用性之间的差距.
主要方法:
- 拉迪内采用集体学习方法,结合视觉转换器和基于扩散的生成模型.
- 视觉变压器编码器块提取分层,不变的特征,对干扰具有坚固的强度.
- 扩散模型作为密度估计器,用于改进数据分布建模和信心校准.
主要成果:
- 在结核病和黑色素瘤数据集上,LaDiNE在最先进的方法上表现优越.
- 该方法同时提高了预测准确性和信心校准.
- 在未见的噪音,对抗性干扰和分辨率降低的情况下显示出有效性.
结论:
- 在存在数据损坏的情况下,LaDiNE为医疗图像分类提供了强大而可靠的解决方案.
- 视觉转换器和扩散模型的结合方法提高了模型的概括性和可信度.
- 这一框架有可能显著提高AI在医学诊断中的临床适用性.
