兼顾公平与优待
针对用户间存在优先待遇需求的公平决策场景,设计了对偶状态增强的DQN变体,能在保持深度强化学习效率的同时显式控制群体公平性。
Guanbao, Yu · Siddique, Umer · Weng, Paul
Lecture Notes in Computer Science 2024
通过广义基尼福利函数对用户赋予不同权重,可在优化公平性的同时满足部分用户的优先需求。
所提随机策略学习方法在无优先待遇的常规公平优化中同样有效。