异构多机器人联盟形成的自学习算法

不确定性下高效联盟

该算法能在任务信息未知的情况下,通过博弈论使机器人形成稳定联盟,并随着交互重复逐步学习到任务的真实类型。

霍鑫 · 张皓 · 王祝萍 · 黄超 · 严怀成

IEEE Transactions on Automation Science and Engineering 2024

技术优势

多项式时间可解

所提联盟形成算法在多项式时间内运行,即使多机器人联盟形成本身是 NP 难的,也能高效求解。

保证收敛

只要通信拓扑强连通,算法严格保证收敛到纳什稳定划分。

在交互中学习

通过动态博弈中的信念更新算法,机器人能在重复博弈中更新对任务类型的认知,最终学习到真实类型。

应用场景