CTD图像修复模型

前景背景更连贯

通过引入过渡区域和CLIP引导的混合扩散,在文本驱动的图像修复中实现掩码区域与背景像素级连贯,支持背景照片的残缺填补。

Zhong, Yan · Xinping, Zhao · Guangzhi, Zhao · Bohua, Chen · 郝飞 · Ruoyu, Zhao · He, Jiaqi · 石磊 · Li, Zhang

Information Fusion 2025

技术优势

前后景更连贯

通过引入过渡区域并在去噪过程中进行混合,约束生成结果与原始背景一致,保证掩码区域与背景无缝衔接。

文本语义更贴合

利用预训练的CLIP模型引导扩散生成过程,使生成内容与文本提示在语义上高度对齐。

连贯性可量化

设计了基于连贯性约束的创新度量指标,将主观的连贯性评估转化为定量测量,便于客观比较方法优劣。

应用场景