黑盒攻击神经排序
一种针对神经排序模型的黑盒对抗攻击方法,通过伪相关反馈学习替代模型来生成文本扰动,在不直接访问模型参数的情况下提升目标文档的排序位置。
吴晨 · 张儒清 · 郭嘉丰 · de Rijke, Maarten · 范意兴 · 程学旗
ACM Transactions on Information Systems 2023
通过伪相关反馈学习替代模型,仅依赖排序位置查询即可生成梯度,适用于真实搜索引擎的黑盒场景。
在两个网络搜索基准数据集上,PRADA 的攻击成功率和目标提升效果均超过已有攻击策略。
对文本添加的修改幅度很小,不易被人工察觉,增强攻击隐蔽性。