时空灵活增收
该算法通过双层多智能体深度强化学习协同优化电动汽车车队的时空转移与充放电决策,在电-碳联合市场中实现套利策略的实时优化。
韩冬 · Huarui, Zhang · Jiawen, Peng · Lu, Zhuoxin · Ren, Xijun
IEEE Transactions on Transportation Electrification 2025
调度模型包含空间转移成本,决策变量不再只是充放电功率,而是同时输出离散的空间转移和连续的充放电动作。
双层多智能体深度强化学习分别处理离散的空间转移决策和连续的充放电决策,避免动作空间混合带来的求解困难。
用真实节点边际电价数据和 30 个充电站位置做案例研究,验证方法有效性,而非仅靠仿真合成数据。