抗视角偏移
通过几何与语义先验引导的粗细粒度交互式差异建模,该网络在视角变化干扰下精准捕捉图像对之间细微的语义差异,解决了变化描述中的精细表征难题。
Shengbin, Yue · Tu, Yunbin · 李亮 · Ying, Yang · 高盛祥 · 余正涛
IEEE Transactions on Multimedia 2023
通过几何-语义交互精炼提取对视角变化鲁棒的先验,使模型在拍摄角度不同时仍能准确捕捉语义变化。
分层表征交互通过语义匹配器和变化放大器从粗到细建模差异,精确定位微小变化。
提供预训练模型和端到端推理代码,可直接集成到现有图像描述系统,无需额外训练。