动作边界更准
分类与定位两任务各取所需,不增参数实现更强视频表征。
汤一平 · 郑阳 · 立陈 · 郭开泰 · Haihong, Hu · 梁继民
Pattern Recognition 2023
全局注意力在整个视频中聚合与动作相似的特征并抑制其他特征,训练过程中增强了表征的判别力。
局部注意力用高斯加权函数整合每个动作及其周围上下文信息,使动作定位更精确。
全局-局部注意力机制在不引入额外参数的情况下产生更强的视频表征,便于部署。