融合多范式长项
将不同范式的基求解器组合成集成求解器,克服单一范式的脆弱性,在不完美信息博弈中显著优于各单项算法。
袁唯淋 · Shaofei, Chen · 李鹏 · 陈璟
Neurocomputing 2023
集成策略学习方法有效地整合了各种先进个体算法的优势,在 Leduc 扑克上面对非平稳对手和有限对局时均显著优于它们。
通过设计三种集成求解器(注意力集成、梯度集成和进化集成),结合不同范式的基求解器,避免了单一范式缺陷导致的脆弱表现。
在 Leduc 扑克中对抗非平稳对手的实验中,集成方法展现了领先的性能,表明其能够应对对手策略的动态变化。