不确定性下高效联盟
该算法能在任务信息未知的情况下,通过博弈论使机器人形成稳定联盟,并随着交互重复逐步学习到任务的真实类型。
霍鑫 · 张皓 · 王祝萍 · 黄超 · 严怀成
IEEE Transactions on Automation Science and Engineering 2024
所提联盟形成算法在多项式时间内运行,即使多机器人联盟形成本身是 NP 难的,也能高效求解。
只要通信拓扑强连通,算法严格保证收敛到纳什稳定划分。
通过动态博弈中的信念更新算法,机器人能在重复博弈中更新对任务类型的认知,最终学习到真实类型。