一个高效的伪装图像细分与修改的UNet和注意力技术
Isha Padhy1,2, Prabhat Dansena1, Sampa Sahoo1
1Department of Computer Science, C V Raman Global University, Bhubaneswar, India.
Scientific reports
|July 2, 2025
概括
伪装对象细分 (COS) 得到了CAMO-UNet的改进,这是一个使用残余块和注意力机制的新型模型. 这种计算机视觉方法增强了对具有挑战性的细分任务的特征学习和准确性.
科学领域:
- 计算机视觉 计算机视觉
- 图像处理 图像处理
- 人工智能的人工智能
背景情况:
- 伪装对象分割 (COS) 是一个复杂的计算机视觉问题,原因是对象与背景混合.
- 像UNet这样的标准模型面临着模两可的边界和纹理相似性的局限性,导致细分错误.
- 现有的方法在具有挑战性的伪装场景中难以准确地分离物体.
研究的目的:
- 介绍CAMO-UNet,这是一种新的深度学习架构,旨在克服伪装对象细分中的传统模型的局限性.
- 为了提高对有复杂伪装图案的对象的细分模型的准确性和稳定性.
- 提高特征表示和深度神经网络中的学习效率,用于计算机视觉任务.
主要方法:
- 拟议的CAMO-UNet集成剩余块,以促进梯度流并实现更深层的网络架构.
- 整合了注意力机制,以专注于突出特征并捕捉远程空间依赖.
- 使用深度感知三角循环学习速率 (CLR) 策略,优化跨不同网络深度的训练动态.
主要成果:
- 在伪装对象细分的基准数据集上,CAMO-UNet实现了93.8%的高精度.
- 该模型在与包括SINet,BGNet和PFNet在内的最先进的方法相比显示出更高的性能.
- 评估显示,关键细分指标 (如S测量,F测量和平均绝对误差 (MAE)) 显著改善.
结论:
- 通过其创新的架构组件,CAMO-UNet有效地解决了伪装对象细分的挑战.
- 剩余块,注意力机制和CLR的整合有助于增强特征学习和细分精度.
- 该模型代表了计算机视觉在复杂环境中准确细分伪装对象方面的重大进步.


