神经符号三维定位模型

可解释定位

用语义场景图显式建模三维场景,以可解释的注意力转移替代黑盒模型,在保持定位精度的同时提供推理路径。

Yixuan, Li · Zan, Wang · 梁玮

Pattern Recognition 2025

技术优势

决策过程可解释

模型使用语义场景图显式建模对象属性和空间关系,每一步注意力转移都基于可解读的指令,而非黑盒计算。

精度不下降

在Sr3D/Nr3D基准上,R2G在提供可解释性的同时,达到了与前期工作相当的定位准确率。

推理过程可定制

通过预设的语义词汇表,用户可以将指代性话语转换成推理指令,控制注意力在图上的转移路径。

应用场景