分层安全强化学习导航方法

导航成功率提升12.1%

通过分层框架缩小任务视野,并结合专家模仿学习与迁移强化学习,该方法在非均质动态环境中实现了更高的导航成功率。

Jianmin, Qin · 刘轻尘 · 马麒超 · Zipeng, Wu · Qin J.

2024

参数信息

导航成功率提升
12.1 %

技术优势

训练更容易

通过分层框架有效缩小强化学习的任务视野,降低了复杂导航策略的训练难度。

泛化性能更强

采用迁移强化学习对策略进行微调,在非均质假设下改善了泛化能力。

性能更优

与现有的分层强化学习导航方法相比,HSRLN在非均质假设下导航成功率提升12.1%。

应用场景