三秒生成表情
用自然语言直接指定说话头的表情风格,无需参考视频也能生成富有表现力的面部动画。
Yifeng, Ma · Wang, Suzhen · Ding, Yu · Bowen, Ma · Lv, Tangjie · Fan, Changjie · Hu, Zhipeng · 邓志东 · Yu, Xin
IEEE Transactions on Multimedia 2025
直接由自然语言描述生成表情,免去了寻找和匹配参考视频的步骤,降低了使用门槛。
通过CLIP的跨模态表示,即使文本描述在训练集中未曾出现,模型也能推断出相应的表情。
不仅指定表情类型,还可以通过文本控制表情的强度,实现更细腻的表情控制。