未知环境高效避障
不同于基于传统稀疏奖励函数的方法,该网络通过将人工势场引入奖励函数形成密集奖励信号,同时结合知识迁移策略,使机器人能够在未知环境中更快地学习导航策略。
Li, Weijie · 岳明 · Shangguan, Jinyong · Jin, Ye
International Journal of Control, Automation and Systems 2023
把人工势场引入奖励函数,通过势能变化引导机器人,缓解稀疏奖励问题,提高学习效率。
提出知识迁移训练方法,把简单环境学到的知识迁移到复杂环境,在已有知识基础上快速学习。
在三维仿真器中验证,机器人获得更高奖励、更高成功率和更短导航时间。