多智能体策略迁移模型

快速适应新协作任务

通过任务关系建模,将已有协作知识迁移到新任务,无需从头训练。

Rongjun, Qin · Feng, Chen · Wang, Tonghan · Yuan, Lei · Xiaoran, Wu · Yipeng, Kang · 章宗长 · 张崇洁 · Yang, Yu

Science China Information Sciences 2024

技术优势

利用任务关系迁移

通过学习效果型任务表示作为公共隐空间,在源任务和目标任务之间共享知识,而不是单纯依靠网络泛化。

泛化到未见任务

任务表示能捕捉团队间的关系,并泛化到未见过的任务,使策略迁移更可靠。

无需从头训练

迁移后的策略能帮助解决从零开始学习很困难的任务,节省训练资源。

应用场景