光流法四十年演进:从Horn-Schunck到RAFT的稠密匹配密度革命

Chapter 1 绪论:光流法的时空坐标系

1.1 从人类视觉到机器感知

当我们凝视一幅动态场景时,视网膜上不断刷新的并非离散的像素点,而是连续的光强流动场。这种生物视觉系统与生俱来的运动感知能力,在计算机视觉领域被抽象为"光流"(Optical Flow)——一个描述图像平面内像素级运动速度与方向的密集向量场。早在1981年,Horn与Schunck在《Determining Optical Flow》一文中便奠定了这一领域的数学基石[1],其提出的平滑性约束与亮度恒定假设,至今仍在各类变分模型中回响。然而,从理论构想到工程落地,光流法经历了长达四十年的迭代演进,每一次技术跃迁都伴随着计算范式、优化目标与应用场景的根本性变革。

光流估计的本质是求解一个病态不适定问题(ill-posed problem)。单帧图像的二维投影丢失了深度信息,而运动物体的遮挡、光照突变与相机噪声进一步加剧了问题的复杂度。早期研究者试图通过施加物理合理的正则化约束来驯服这一病态性,而深度学习时代的来临则将数据驱动思想注入其中,使得模型从"手工设计"转向"自动学习"。2020年,RAFT(Recurrent All-Pairs Field Transforms)的提出标志着光流估计进入了一个新纪元——它摒弃了传统金字塔由粗到精的单向传播,转而采用循环神经网络在固定分辨率下进行迭代精修,将稠密匹配的密度与精度推向了前所未有的高度[2]。这一范式转变不仅刷新了KITTI与Sintel等权威榜单,更重要的是为实时视频稳定、自动驾驶、动作识别等下游任务提供了可部署的高性能解决方案。

1.2 光流法的数学本质

在数学层面,光流估计可形式化为能量最小化问题。设图像序列为I(x,y,t) ,像素在时间t 的位移为

评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

智算菩萨

欢迎阅读最新融合AI编程内容

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值