多摄像头时空深度学习框架,用于在密集的城市环境中实时检测异常行为
Sai Babu Veesam1, B Tarakeswara Rao2, Zarina Begum3
1School of Computer Science and Engineering, VIT-AP University, Amaravathi, 522241, India. saibabuv@gmail.com.
Scientific reports
|July 23, 2025
概括
这项研究引入了一种深度学习框架,用于多摄像头检测异常行为,大大降低了假阳性和计算成本. 它通过改善对未见异常的概括和降低检测延迟来增强实时人群监控.
科学领域:
- 计算机视觉 计算机视觉
- 人工智能的人工智能
- 监控系统 监控系统
背景情况:
- 由于人口密度不断增加,城市环境在实时检测异常方面面临挑战.
- 现有的方法在阻塞,动态场景和计算效率低下方面扎,导致错误的阳性和糟糕的概括.
- 传统和当前的深度学习模型未能在拥挤的场景中捕捉复杂的社会相互作用和时空依赖.
研究的目的:
- 提出一种新的深度学习框架,用于多摄像头使用时空信息检测异常行为.
- 解决现有方法在处理复杂相互作用,计算负载和对未见异常的概括方面存在的局限性.
- 通过适应性可扩展性和资源配置来增强实时人群监控能力.
主要方法:
- 多尺度图表注意网络 (MS-GAT) 用于交互意识的异常检测.
- 基于强化学习的动态摄像头注意力转换器 (RL-DCAT) 用于优化监视焦点和减少计算开销.
- 空间时空反向对比学习 (STICL) 具有异常记忆,以改善对罕见异常的概括.
- 基于事件的神经形态编码,使用尖端神经网络进行快速动作分析.
- 生成性行为合成和代学习的少量适应 (BGS-MFA),用于合成新的异常行为和少量适应.
主要成果:
- 通过MS-GAT,假阳性病例的减少率高达30%.
- RL-DCAT 降低了 40% 的计算开销,并增加了 15% 的回忆.
- STICL提高了未见异常的回忆率25%.
- 神经形态编码降低了60%的检测延迟.
- BGS-MFA 提高了异常检测概括率的 35%.
- 总体框架评估显示,虚假警报减少了40%,计算需求降低了50%,基准数据集的实时效率降低了98%.
结论:
- 拟议的多方面的深度学习框架有效地解决了当前异常行为检测系统的局限性.
- 集成MS-GAT,RL-DCAT,STICL,神经形编码和BGS-MFA,为实时多摄像头人群监控提供了一个强大的解决方案.
- 该框架在准确性,效率和通用性方面取得了显著的改进,为先进的现实应用铺平了道路.


