双流SVT姿态估计网络

无相机参数高精度

同时利用图像与姿态模态,通过空间-视角-时序三轴协同建模,摆脱对相机参数和人体先验的依赖。

Zhang, Wanruo · 刘梦源 · Li, Wenhao · 刘宏

Pattern Recognition 2026

参数信息

MPJPE(Human3.6M)
17.3 mm

技术优势

不用相机参数

模型不依赖相机参数和人体先验,部署时无需标定投影矩阵,简化多视角设置流程。

双流补足视觉上下文

同时输入2D姿态序列和原始图像特征,通过跨模态交互融合,弥补单流方法丢失的视觉线索,提升估计精度。

三轴相关性建模

编码器在空间、视角、时间三个维度上联合建模,每个解码层包含三个轴感知的相关性模块,捕获全局跨视角关系和时序依赖。

应用场景