人本多模态融合网络

通过骨骼引导将深度、RGB与光流转换为以人为中心的图像,该多模态融合网络在细粒度动作判别和跨视角识别上显著增强了骨骼基方法的鲁棒性。

Zesheng, Hu · Jian, Xiao · Le, Li · Cun, Liu · Ji, Genling Lin

Expert Systems with Applications 2024

技术优势

细粒度动作分得清

融合深度、RGB和光流模态,以人体关键点为指导生成以人为中心的图像,提供人与物体交互信息。

跨视角鲁棒

通过多模态融合增强视角不变性,在变化视角下仍能准确识别动作。

推理速度快

网络在保证性能的同时实现快速推理,适合实时应用。

应用场景