可迁移嵌入反演攻击

无模型查询即可反演

攻击者无需访问原始嵌入模型,仅通过替代模型即可反演文本嵌入中的敏感信息,揭示实际场景中的隐私风险。

Huang, Yuhsiang · Tsai, Yuche · Hsiang, Hsiao · Hong-Yi, Lin · Lin, Shou-De

2024

技术优势

无需访问目标模型

攻击者通过训练替代模型模拟受害者模型行为,即可在没有原始模型查询权限的情况下实施反演,扩大了攻击面。

跨模型可迁移

实验表明,该攻击在不同嵌入模型之间具有迁移性,即在一个模型上训练的替代模型可有效攻击另一个模型,增强了攻击的实用性。

真实数据上有效

在临床数据集上的成功攻击表明,该方法能够对真实敏感的医疗文本嵌入恢复隐私信息,而不仅限于人工数据集。

显著优于传统方法

与传统的嵌入反演方法相比,所提出的迁移攻击在恢复效果上有显著提升,证明了该威胁模型的严重性。

应用场景