速度与方案质量双优
专为敏捷卫星调度问题设计的深度强化学习构建模型,在求解速度和方案质量上均超越现有算法。
Chen, Ming · Du, Yonghao · 唐珂 · 邢立宁 · 陈宇宁 · 陈英武
IEEE Transactions on Systems, Man, and Cybernetics: Systems 2024
深度强化学习构建模型在决策过程中采用端到端策略,无需反复迭代搜索,从而显著缩短了求解时间。
模型学习到的构建启发式在实验中获得了比现有最优算法更好的调度方案,表明其解的质量更高。
模型在未见的实例上可直接应用,无需针对每个新问题重新训练或调整参数。