超参数更少,性能更优
该模型通过重要性函数构造合成奖励,在简化超参数和模型复杂度的同时实现优于现有方法的交通信号控制性能。
Liu, Junxiu · Qin, Sheng · 苏珉 · 罗玉玲 · 张顺生 · Wang, Yanhu · Yang, Su
Expert Systems with Applications 2023
通过仅设计单个奖励函数并结合重要性函数构造合成奖励,减少了需要调节的超参数数量。
模型复杂度降低,使得部署和维护更简便。
实验表明该方法在不同交通环境下性能优于大多数现有的强化学习交通信号控制方法。