高速抗扰更敏捷
一种结合结构化参考步态与不对称Actor-Critic架构的强化学习控制器,使双足机器人获得更强抗扰、更精确速度跟踪的奔跑能力。
Yunpeng, Liang · Zhihui, Peng · Zhao Y. · Yan, Weixin
Robotica 2026
通过参考轨迹引导策略学习,控制器能更精确地跟随目标速度,使机器人在实际部署中速度控制更可靠。
非对称Actor-Critic架构利用双历史观测提取环境潜变量,缩小模拟到现实差距,使控制器在受到外部扰动时仍保持步态稳定。
控制器学习到的弹簧-质量奔跑动力学保持鲁棒性,在非平坦地面上也能稳定运行,无需额外地形估计。