语义先导融合网络

免标注自适应融合

利用CLIP与DINO提取的全局和局部语义先验,无需手工标注即可指导红外与可见光图像自适应融合,同时提升视觉效果与语义精度。

Zhang H. · Yao S. · Ma J. · Jiang J. · Zhang Y. · Zhou H.

Information Fusion 2026

技术优势

免标注

利用CLIP和DINO的预训练能力提取语义先验,无需任何人工标注数据即可实现语义理解。

互补语义先验

CLIP提供全局语义对齐,DINO捕捉细粒度局部语义,两者互补,实现对源图像的全面理解。

自适应融合

语义先验通过专门设计的语义自适应融合网络引导融合过程,根据语义内容自适应地突出各模态的独特特征。

性能领先

在公开数据集上的大量评估表明,SPGFusion在视觉质量和语义准确度上均优于现有最先进方法。