抗扰动视觉Transformer

密文图像精准检索

通过注意力令牌感知机制,在加密图像上实现端到端表征学习,检索精度优于现有基于CNN的方法。

Qihua, Feng · Zhixun, Lu · Li, Chaozhuo · 黄斐然 · 翁健 · Yu, Philip S.

Information Fusion 2025

技术优势

无需人工特征

端到端学习直接从加密图像中提取表达性表示,省去人工特征工程。

抗空间置换

基于ViT并结合层级分块加密,模型能捕捉全局关系,对块置换和遮挡具有鲁棒性。

数据少也能训

自适应构造与加密操作一致的增强样本,缓解数据荒漠问题,提升模型泛化。

应用场景