在数据依赖下交叉验证策略:使用眼结膜图像预测绵羊贫血的例子
Luara A Freitas1, Rafael E P Ferreira1, Anderson A C Alves2
1University of Wisconsin, Department of Animal and Dairy Sciences, Madison, WI 53706, USA.
Preventive veterinary medicine
|March 9, 2026
概括
选择正确的验证方法对于牲畜中的计算机视觉至关重要. 农场级验证为识别贫血绵羊提供了现实的绩效估计,与可能高估准确性的随机分割不同.
科学领域:
- 兽医医学 兽医医学 兽医医学
- 机器学习 机器学习
- 计算机视觉 计算机视觉
背景情况:
- 计算机视觉对于畜牧健康监测至关重要,但其预测准确性在很大程度上依赖于强大的验证方法.
- 确保在不同的农场和管理条件上进行可概括的预测对于现实世界的应用至关重要.
研究的目的:
- 评估三种交叉验证 (CV) 策略对使用眼镜图像识别贫血羊的深度学习模型性能的影响.
- 为了进行模型验证,比较随机分割 (Rsplit),基于动物的分割 (Asplit) 和基于农场的分割 (Fsplit).
主要方法:
- 使用了来自三个农场的186只绵羊的1176张智能手机图像的数据集.
- 图像使用U-Net进行分段处理,VGG19用于基于包装细胞体积 (PCV) 的贫血预测.
- 应用了三个CV策略 (Rsplit,Asplit,Fsplit) 来评估模型性能,使用准确性,精度,回忆,F1得分和特异性等指标.
主要成果:
- 随机分割 (Rsplit) 通常会产生更高的性能指标,可能会高估模型的准确性.
- 与Rsplit.相比,以动物为基础的分割 (Asplit) 的准确性降低了24%.
- 基于农场的分割 (Fsplit) 导致准确度 (34%) 和F1得分 (15%) 显著下降,表明在新的农场条件下预测能力降低.
结论:
- 选择CV策略显著影响计算机视觉模型在畜牧业中的估计性能.
- 农场级验证为兽医应用提供了更保守,更现实的模型通用性估计.
- 将CV战略与部署场景保持一致对于开发可靠和强大的动物卫生AI工具至关重要.


