语义调制扩散模型

语义引导水下增强

一种集成多级语义引导的扩散模型,用于水下图像增强,在多种退化条件下优于现有方法。

Guodong, Fan · Shengning, Zhou · Hua, Zhen · 李晋江 · 周景春

Information Fusion 2026

技术优势

语义感知增强

LLaVA 视觉语言模型提供场景理解,使增强过程能够根据语义区域调整局部处理,避免无差别增强。

局部条件精化

窗口化图文融合将文本语义与局部图像特征对齐,生成空间变化的引导条件,为扩散模型提供初始蓝图。

关键区域聚焦

可变形注意力机制根据图像-文本交互产生的导航图,使去噪网络更关注语义上重要的区域。

应用场景