将人体图结构注入MLP架构,单帧与视频3D姿态估计均达最先进水平
Li, Wenhao · 刘梦源 · 刘宏 · Tianyu, Guo · Ti, Wang · Tang, Hao · Sebe, Niculae
Pattern Recognition 2025
通过将图结构引入MLP,同时对单张图像和视频序列进行3D姿态估计,扩展简单且计算开销可忽略。
完全基于MLP和图卷积的混合架构,避免了自注意力机制的高计算负担,同时达到最先进性能。
将人体骨骼图结构显式编码进网络,使模型天然符合3D姿态的领域需求。