作者:西安交大的De Cheng, Yihong Gong, Sanping Zhou, Jinjun Wang, Nanning Zheng
主要贡献:
贡献有两个,一个是改进的网络结构,一个是改进的triplet loss.
网络结构:
该网络结构一共有5个channels,其中一个是整个身体的channel,其他四个对应四个parts的channels。
其中:
full-body channel: global convolution layer(7\times 7 \times 32 \/3)+max-pooling(3\times 3)+fulll-body convolution layer(5\times 5)+max-pooling(3\times 3)+full-connection layer(400d)
body part channel:
1\frac 4 global convolution layer+body-part convolution layer(3\times 3)+full-connection layer(100d)
最后串联在一起,一共800维。
improved loss
除了关注类内和类间的分离度,也关注类内的紧密性。
实验
数据集
在四个数据集上测试:
i-LIDS
PRID2011
VIPeR
CUHK01
1、评估网络结构和改进loss的性能
四个Variants
variant 1(oursT): 移除4个body-part channels+ original loss
variant 2(oursTC):移除4个body-part channels+improved loss
variant 3(oursTP): multi-channel CNN+ original loss
variant 4(oursTPC):multi-channel CNN+improved loss
在四个数据集上的评估结果
2.loss function中beta值对结果的影响
3. 不同身体部分对结果的影响
model: 一个full-body channel + 一个body part channel.
本文提出了一种改进的人脸识别网络结构,包括一个整体身体通道和四个局部身体通道,并结合改进的triplet loss损失函数,提高了人脸识别的效果。在i-LIDS、PRID2011、VIPeR和CUHK01四个数据集上进行了详细的实验验证。

1万+

被折叠的 条评论
为什么被折叠?



