密集动态场景近零碰撞
面向室内密集动态障碍的混合强化学习算法,通过注意力表征与新型数据回放,收敛质量优于现有方法。
Zhou, Chengmin · Huang, Bingding · Fränti, Pasi
IEEE Transactions on Neural Networks and Learning Systems 2023
在密集动态障碍场景下成功率达到近100%,避免碰撞。
相比现有最优方法,到达目标所需时间更短。
收敛性能优于可训练的最先进方法。