语义引导水下增强
一种集成多级语义引导的扩散模型,用于水下图像增强,在多种退化条件下优于现有方法。
Guodong, Fan · Shengning, Zhou · Hua, Zhen · 李晋江 · 周景春
Information Fusion 2026
LLaVA 视觉语言模型提供场景理解,使增强过程能够根据语义区域调整局部处理,避免无差别增强。
窗口化图文融合将文本语义与局部图像特征对齐,生成空间变化的引导条件,为扩散模型提供初始蓝图。
可变形注意力机制根据图像-文本交互产生的导航图,使去噪网络更关注语义上重要的区域。