性能提升5%–30%
该框架通过模拟退火算法优化包裹取送顺序,并利用深度强化学习优化无人机飞行轨迹,在降低能耗和通信中断的同时提升用户满意度。
Jiangling, Cao · 杨亮 · 杨鼎成 · 张天魁 · Xiao, Lin · 蒋洪波 · Niyato, Dusit (Tao)
IEEE Transactions on Mobile Computing 2024
在求解能耗、通信质量与用户满意度的性能权衡问题上,PDU策略相较其他策略性能提升约5%–30%。
通过深度强化学习优化飞行轨迹,从而保证无人机与地面基站之间的预期通信质量。
先在模拟退火阶段获取包裹取送顺序,再基于该顺序进行轨迹优化,避免顺序与轨迹分离导致的次优结果。