双层MADRL调度算法

时空灵活增收

该算法通过双层多智能体深度强化学习协同优化电动汽车车队的时空转移与充放电决策,在电-碳联合市场中实现套利策略的实时优化。

韩冬 · Huarui, Zhang · Jiawen, Peng · Lu, Zhuoxin · Ren, Xijun

IEEE Transactions on Transportation Electrification 2025

参数信息

平均日收益
1968.7 $
充电站数量
30

技术优势

空间维度不再缺位

调度模型包含空间转移成本,决策变量不再只是充放电功率,而是同时输出离散的空间转移和连续的充放电动作。

离散连续动作协同

双层多智能体深度强化学习分别处理离散的空间转移决策和连续的充放电决策,避免动作空间混合带来的求解困难。

真实数据可落地

用真实节点边际电价数据和 30 个充电站位置做案例研究,验证方法有效性,而非仅靠仿真合成数据。

应用场景