布局解耦生成
将密集视角视频生成解耦为粗布局生成与结构感知条件生成,兼顾视角一致性与时序一致性,支持更高精度的4D表征优化。
Yang, Shuzhou · Cun, Xiaodong · Li, Xiaoyu · Yaowei, Li · 长江
International Journal of Computer Vision 2026
将4D生成分解为粗多视角布局生成与结构感知条件生成两个子任务,避免在单一模型中同时处理空间与时间维度的耦合,从而降低高维数据直接生成的难度。
先预测具有优越跨视角和时间一致性的密集视角布局,再基于布局先验进行结构感知的条件生成,使最终密集视角视频在视角间和时间上保持一致。
生成的高质量密集视角视频可作为精确优化显式4D表征(如4D高斯)的输入,从而支持更广泛的实际应用。
在novel view synthesis和4D generation任务上均达到当前最优性能,证明了方法的有效性。