部分信息下提升效用
该算法结合可微分神经计算机与优势演员评论家框架,利用外部记忆探索策略空间,在车辆间信息受限的动态场景中实现近似最优卸载决策。
Jing, Zhang · 沈斐 · 燕锋 · Jie, Li
IEEE Transactions on Network Science and Engineering 2026
在真实数据集上,计算卸载效用相比现有方案有明显提升。
通过调整奖励表示,训练效率提高,算法收敛速度加快。