分布追逃博弈算法

无模型在线学习

一种基于分布式相对距离误差和通信成本项的新型性能指标,能够在无动力学模型和初始稳定策略的条件下在线学习最优追逃策略。

Wang, Qiufeng · 胡斌 · 关治洪 · 张顶学 · 李涛

IEEE Transactions on Aerospace and Electronic Systems 2025

技术优势

无需动力学模型

算法直接从轨迹数据在线学习最优策略,不需要事先知道系统动力学,省去了系统辨识步骤。

无需初始稳定策略

学习过程不要求一个初始稳定的控制策略,降低了部署门槛。

误差有显式上界

理论分析给出了闭环误差的一致最终有界性保证和显式界,便于评估鲁棒性。

应用场景