动态视频更逼真
通过结合首尾帧图像指令与文本指令,该扩散模型突破了现有方法生成视频动作单一的局限,更擅长合成复杂场景与精细运动。
Yan, Zeng · Wei, Guoqiang · Jiani, Zheng · Jiaxin, Zou · Yang, Wei · Yuchen, Zhang · Li, Hang
2024
通过首尾帧图像与文本共同约束生成过程,模型能合成复杂场景下的精细运动。
模型完全基于公开数据训练,无需额外专有数据集。