基于YOLO的智能视频监控异常行为检测研究:从算法原理到落地部署的全栈实践
摘要
本文深入探讨如何利用 YOLO(You Only Look Once)系列算法构建一套端到端的异常行为检测系统。文章首先回顾 YOLOv8 在时空建模上的局限,然后提出“YOLO-STA(Spatio-Temporal Aggregation)”轻量级改进框架,在公开数据集 UCF-Crime 上将异常行为检测的 mAP@0.5 从 72.4 提升到 80.1;接着给出完整训练、推理、部署的 Python 代码(PyTorch + TensorRT),并介绍如何仅用 4 GB 显存的 Jetson Xavier NX 实现 25 FPS 的实时边缘端运行。
1 研究背景与挑战
1.1 异常行为检测的业务痛点
- 传统基于规则(越界、区域入侵)的算法无法覆盖“打架”“跌倒”“纵火”等复杂语义;
- 现有行为识别模型(SlowFast、TSM)参数量大,难以在边缘设备实时运行;
- 标注成本高:1 分钟异常视频需要 5–10 分钟精细标注。
1.2 YOLO 系列在时间维度上的不足
YOLOv8 默认输入为静态图像,对时序信息利用不足。我们在 UCF-Crime 50 K 帧测试集上发现,单帧推理将“盗窃”漏检率从 18 % 提升到 37 %,说明仅靠空间特征难以区分“正常弯腰”与“行窃弯腰”。
订阅专栏 解锁全文

333

被折叠的 条评论
为什么被折叠?



