图增强MLP姿态估计器

将人体图结构注入MLP架构,单帧与视频3D姿态估计均达最先进水平

Li, Wenhao · 刘梦源 · 刘宏 · Tianyu, Guo · Ti, Wang · Tang, Hao · Sebe, Niculae

Pattern Recognition 2025

技术优势

单帧视频都能跑

通过将图结构引入MLP,同时对单张图像和视频序列进行3D姿态估计,扩展简单且计算开销可忽略。

不用自注意力

完全基于MLP和图卷积的混合架构,避免了自注意力机制的高计算负担,同时达到最先进性能。

人体结构先验内置

将人体骨骼图结构显式编码进网络,使模型天然符合3D姿态的领域需求。

应用场景