协调知识可迁移
该框架通过联盟模式分解实现协调级知识迁移,并适配动态智能体数量,在星际争霸II微观管理基准上表现优于现有方法。
Tianze, Zhou · 张福彪 · Shao, Kun · Dai, Zipeng · 李凯 · Huang, Wenhan · Wang, Weixun · Wang, Bin · Li, Dong · Liu, Wulong · 郝建业
IEEE Transactions on Games 2023
通过分解智能体协调为多层联盟模式,在协调层面进行知识迁移,从而减少偏差。
通过PIT网络处理动态观测和动作空间,能够在智能体数量改变时保持性能。
在星际争霸II微观管理基准上,性能超过多种先进MARL方法。