【6Dof位姿估计】PVN3D: A Deep Point-wise 3D Keypoints Voting Network for 6DoF Pose Estimation 论文理解

本文详细介绍了PVN3D论文,该网络结合颜色和深度信息预测6自由度位姿,通过3D关键点检测、实例语义分割和中心点投票三个模块实现。实验表明,3D关键点预测在ADD-S指标上优于2D关键点,并且网络结构中的各个模块相互增强,提高了位姿估计的鲁棒性。


论文代码

本文创新点\贡献

使用颜色和深度信息,结合先验关键点来预测6DoF


方法

在这里插入图片描述

方法概述

对彩色和深度信息分别取特征信息然后融合,对提前定义好的关键点、每个点的分类label、中心点偏移进行预测,使用mean shift聚类来解决不同实例的划分,最后用最小二乘来拟合世界坐标系和摄像机坐标系的变换

三个模组

  • 关键点预测,预测关键点的偏移
  • 分割,预测个每个点的语义label
  • 中心点投票,投票中心点的偏移

3D Keypoints Detection Module

在这里插入图片描述
使用特征提取模组来提取全部点的特征,预测每个target点的欧氏距离偏移,然后根据这些预测来投票,然后用聚类算法,选择聚类的中心点作为投票选出来的关键点

操作
给定一些图片上的点 { p i } i = 1 N \{ p_i \}^N_{i=1} { pi}i=1N还有一系列选出来的关键点 { k p j } j = 1 M \{ kp_j \}^M_{j=1} { kpj}j=1M,然后定义 p i = [ x i ; f i ] p_i = [x_i;f_i] pi=[xi;fi],其中 x i x_i xi是3D坐标, f i f_i fi是提取的特征。定义 k p j = [ y j ] k_{p_j}=[y_j] kpj=[yj] y j y_j yj是关键点的3D坐标

2D点本身怎么会有3D坐标呢?齐次化?
不是,是使用的点云位置信息

M K M_K MK利用每个点的 f i f_i fi来生成他们的位置偏移 { o f i j } j = 1 M \{ of^j_i \}^M_{j=1} { ofij}j=1M i f i j if^j_i ifij表示从第 i i i个点到第 j j

评论 13
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值