PVN3D: A Deep Point-wise 3D Keypoints Voting Network for 6DoF Pose Estimation 论文理解
本文创新点\贡献
使用颜色和深度信息,结合先验关键点来预测6DoF
方法

方法概述
对彩色和深度信息分别取特征信息然后融合,对提前定义好的关键点、每个点的分类label、中心点偏移进行预测,使用mean shift聚类来解决不同实例的划分,最后用最小二乘来拟合世界坐标系和摄像机坐标系的变换
三个模组
- 关键点预测,预测关键点的偏移
- 分割,预测个每个点的语义label
- 中心点投票,投票中心点的偏移
3D Keypoints Detection Module

使用特征提取模组来提取全部点的特征,预测每个target点的欧氏距离偏移,然后根据这些预测来投票,然后用聚类算法,选择聚类的中心点作为投票选出来的关键点
操作:
给定一些图片上的点 { p i } i = 1 N \{ p_i \}^N_{i=1} {
pi}i=1N还有一系列选出来的关键点 { k p j } j = 1 M \{ kp_j \}^M_{j=1} {
kpj}j=1M,然后定义 p i = [ x i ; f i ] p_i = [x_i;f_i] pi=[xi;fi],其中 x i x_i xi是3D坐标, f i f_i fi是提取的特征。定义 k p j = [ y j ] k_{p_j}=[y_j] kpj=[yj]中 y j y_j yj是关键点的3D坐标
2D点本身怎么会有3D坐标呢?齐次化?
不是,是使用的点云位置信息
M K M_K MK利用每个点的 f i f_i fi来生成他们的位置偏移 { o f i j } j = 1 M \{ of^j_i \}^M_{j=1} { ofij}j=1M, i f i j if^j_i ifij表示从第 i i i个点到第 j j

本文详细介绍了PVN3D论文,该网络结合颜色和深度信息预测6自由度位姿,通过3D关键点检测、实例语义分割和中心点投票三个模块实现。实验表明,3D关键点预测在ADD-S指标上优于2D关键点,并且网络结构中的各个模块相互增强,提高了位姿估计的鲁棒性。

1856

被折叠的 条评论
为什么被折叠?



