四数据集领先
通过空间-视觉对齐与帧间差异建模,同时增强手部与表情的判别性特征提取。
Wenjie, Yin · 侯永宏 · Guo, Zihui · Kailin, Liu
IEEE Transactions on Circuits and Systems for Video Technology 2023
通过空间-视觉对齐(SVA)模块,利用目标注释序列进行辅助任务,增强手部和面部表情特征的提取。
时序特征差异(TFD)模块利用连续帧之间的潜在动态,将聚合的运动信息注入空间特征,辅助短时时序建模。