广义基尼公平深度强化学习

兼顾公平与优待

针对用户间存在优先待遇需求的公平决策场景,设计了对偶状态增强的DQN变体,能在保持深度强化学习效率的同时显式控制群体公平性。

Guanbao, Yu · Siddique, Umer · Weng, Paul

Lecture Notes in Computer Science 2024

技术优势

支持优先待遇

通过广义基尼福利函数对用户赋予不同权重,可在优化公平性的同时满足部分用户的优先需求。

适用于标准公平场景

所提随机策略学习方法在无优先待遇的常规公平优化中同样有效。

应用场景