Benchmarking Compact VLMs for Clip-Level Surveillance Anomaly Detection Under Weak Supervision

Kirill Borodin1, Kirill Kondrashov1, Nikita Vasiliev1

  • 1Faculty of Information Technology, Moscow Technical University of Communication and Informatics, Moscow 111024, Russia.

Journal of Imaging
|November 26, 2025
PubMed
Summary

Compact vision-language models (VLMs) offer a practical solution for CCTV anomaly detection, balancing accuracy and speed. Parameter-efficient fine-tuning enhances their reliability and consistency for real-time safety monitoring.