隐私防护低损耗
一种针对预测置信分数的净化方法,通过抑制成员与非成员数据在形状、分布和标签三个维度上的可区分性,实现对成员推理攻击的鲁棒防御,同时保持模型准确率几乎不变。
Yang, Ziqi · Yiran, Zhu · Jie, Wan · Chuxiao, Xiang · Tong, Tang · 王艺霖 · Ruite, Xu · Lijin, Wang · 张帆 · Xu, Jiarong · 秦湛
IEEE Transactions on Dependable and Secure Computing 2024
Purifier 在个体形状、统计分布和预测标签三个维度上量化并减少成员与非成员之间的差异,而不是仅关注单一指标。
在大多数数据集上,净化后的模型分类准确率下降非常小,保持了原有模型的实用性。
与之前的防御技术相比,Purifier 提供了更强的成员推理攻击防御效果。
实验表明,Purifier 还能有效防御模型反演攻击和属性推理攻击。