导航成功率提升12.1%
通过分层框架缩小任务视野,并结合专家模仿学习与迁移强化学习,该方法在非均质动态环境中实现了更高的导航成功率。
Jianmin, Qin · 刘轻尘 · 马麒超 · Zipeng, Wu · Qin J.
2024
通过分层框架有效缩小强化学习的任务视野,降低了复杂导航策略的训练难度。
采用迁移强化学习对策略进行微调,在非均质假设下改善了泛化能力。
与现有的分层强化学习导航方法相比,HSRLN在非均质假设下导航成功率提升12.1%。