自适应元强化学习算法

动态场景仿真到现实

通过任务池、好奇心机制和优先经验回放,使智能体在动态场景中高效学习,尤其适用于未见过的场景。

Xiao, Wenwen · 骆祥峰 · 谢少荣 · 宇航

IEEE Transactions on Intelligent Vehicles 2025

技术优势

在动态变化的虚拟场景中高效完成任务

在真实场景中具有良好的适应性