非对称信息下最优决策
利用自治系统与对手之间的信息不对称,通过超博弈框架生成欺骗策略,有效提升任务平均收益,适用于对抗环境下的高层任务规划。
Lv, Peng · Li, Shaoyuan · 殷翔
IEEE Transactions on Intelligent Vehicles 2024
通过欺骗策略利用信息不对称,系统可以在对手持有错误信念时获得更高的平均收益。
所提出的基于超博弈的算法可针对加权双人图博弈模型综合出最优欺骗策略,并保证正确性。
通过仿真和实证实验验证了算法在实际场景中的适用性,而不仅限于理论分析。