深度图像模型:原理、应用与优化
1. 深度卷积滤波器学习
在图像模型的学习中,我们可以在不需要目标边界框或图像对齐的情况下学习新的滤波器层。例如,在第一个风景实验中,基于预训练的 VGG 第三层滤波器,我们在第四卷积层学习 10 个滤波器,每个待学习的 Conv4 滤波器大小为 11 × 11 × 256。在第二个向日葵实验中,学习 20 个大小为 7 × 7 × 256 的滤波器。这些学习到的滤波器能够捕捉局部对象或模式,并将它们无缝重组。
2. 深度卷积能量模型
我们可以从头开始学习滤波器 ${F_k^{(l)}, k = 1, \ldots, K}$,得到的模型是深度卷积能量模型(EBM),其概率分布为:
[p(\mathbf{I}; \theta) = \frac{1}{Z(\theta)} \exp{f(\mathbf{I}; \theta)} q(\mathbf{I})]
其中,$f(\mathbf{I}; \theta)$ 由卷积神经网络(ConvNet)定义,$\theta$ 收集了 ConvNet 的所有权重和偏置参数。在特定模型中,$f(\mathbf{I}; \theta)$ 可以表示为:
[f(\mathbf{I}; \theta) = \sum_{j = 1}^{J} \sum_{x \in \mathcal{D}} F_j^{(l + 1)} * \mathbf{I} ]
使用更紧凑的符号,$f(\mathbf{I}; \theta)$ 可以递归定义为:
[\mathbf{I}^{(l)} = h(w_l \mathbf{I}^{(l
超级会员免费看
订阅专栏 解锁全文

8325

被折叠的 条评论
为什么被折叠?



