用于作物疾病识别的零实例深度持续学习:对视觉转换器中总变异注意力规范化的研究
1School of Computer Science and Engineering, Faculty of Innovation Engineering, Macau University of Science and Technology, Macao, Macao SAR, China.
Frontiers in plant science
|January 19, 2024
概括
这项研究引入了一个新的视觉变压器与总变化 (ViT-TV) 模型用于植物疾病识别. ViT-TV方法有效地解决了农业人工智能持续学习中的灾难性遗忘问题.
科学领域:
- 人工智能的人工智能
- 计算机视觉 计算机视觉
- 农业科学 农业科学
背景情况:
- 人工智能和深度学习在食品工业应用中表现有希望,例如植物疾病识别.
- 持续学习模型在学习新的植物疾病时,与灾难性遗忘作斗争.
- 现有的研究缺乏可以不断学习新疾病,同时减轻遗忘的模型.
研究的目的:
- 评估先进的计算机视觉模型,用于识别食品疾病中的多种疾病持续学习.
- 引入一种新的视觉转换器架构,用于在作物疾病识别中进行持续学习.
- 解决灾难性遗忘在人工智能模型中面临的挑战,以识别植物疾病.
主要方法:
- 收集并利用PlantDiseaseCL数据集用于各种作物疾病图像.
- 采用视觉变压器 (ViT) 模型进行初始植物疾病图像分类.
- 提出了一个新的ViT-TV架构,使用总变量 (TV) 基于距离的损失 (TV-Loss) 来保持注意力的一致性.
主要成果:
- 在联合学习中,ViT模型实现了高性能:准确性 (0.9538),精度 (0.9532),回忆 (0.9528) 和F1得分 (0.9560).
- 在植物病CL数据集上,ViT-TV方法在增量学习方面表现优异 (3步:0.7077,5步:0.5661准确度).
- ViT-TV的表现优于各种零示例和基于示例的持续学习策略.
结论:
- ViT-TV方法有效地减轻了在不经事先任务样本的情况下不断学习植物疾病识别的灾难性遗忘.
- 这种新的架构支持农业和食品工业的长期智能发展.
- ViT-TV在持续学习场景中显示出显著的适用性,用于作物疾病图像识别.


