图像指令视频生成模型

动态视频更逼真

通过结合首尾帧图像指令与文本指令,该扩散模型突破了现有方法生成视频动作单一的局限,更擅长合成复杂场景与精细运动。

Yan, Zeng · Wei, Guoqiang · Jiani, Zheng · Jiaxin, Zou · Yang, Wei · Yuchen, Zhang · Li, Hang

2024

技术优势

动作幅度明显提升

通过首尾帧图像与文本共同约束生成过程,模型能合成复杂场景下的精细运动。

公开数据即可训练

模型完全基于公开数据训练,无需额外专有数据集。

应用场景