多注意力6D姿态估计网络

类别级精度双榜领先

通过多注意力增强跨模态特征交互与实例重构,显著提升类别级6D姿态估计精度。

Haotian, Lei · Xiangyu, Liu · 周燕 · 牛菓 · 易长安 · Zhou, Yuexia · Xiaofeng, Liang · Fuhe, Liu

Image and Vision Computing 2025

参数信息

3D75 精度
79.0 %
3D75 精度
91.2 %
5°2 cm 精度
52.6 %
5°2 cm 精度
75.9 %

技术优势

跨模态特征深度融合

通过多注意力交互,增强图像、观测点云和先验形状之间的内在联系,使网络更深入理解实例差异。

几何细节保真

实例重构形变模块为每个物体重建三维实例点云,增强对几何配置差异的识别能力。

双基准领先

在 CAMERA25 和 REAL275 上均超越当前主流方法,验证了方法的有效性。

应用场景