无相机参数高精度
同时利用图像与姿态模态,通过空间-视角-时序三轴协同建模,摆脱对相机参数和人体先验的依赖。
Zhang, Wanruo · 刘梦源 · Li, Wenhao · 刘宏
Pattern Recognition 2026
模型不依赖相机参数和人体先验,部署时无需标定投影矩阵,简化多视角设置流程。
同时输入2D姿态序列和原始图像特征,通过跨模态交互融合,弥补单流方法丢失的视觉线索,提升估计精度。
编码器在空间、视角、时间三个维度上联合建模,每个解码层包含三个轴感知的相关性模块,捕获全局跨视角关系和时序依赖。