可解释定位
用语义场景图显式建模三维场景,以可解释的注意力转移替代黑盒模型,在保持定位精度的同时提供推理路径。
Yixuan, Li · Zan, Wang · 梁玮
Pattern Recognition 2025
模型使用语义场景图显式建模对象属性和空间关系,每一步注意力转移都基于可解读的指令,而非黑盒计算。
在Sr3D/Nr3D基准上,R2G在提供可解释性的同时,达到了与前期工作相当的定位准确率。
通过预设的语义词汇表,用户可以将指代性话语转换成推理指令,控制注意力在图上的转移路径。