即时检测恶意触发输入
利用被攻陷模型无法将后门行为转移到未感染模型这一内在弱点,在运行时甄别输入,无需训练、无需专业知识。
Yinshan, Li · Ma, Hua · Zhang, Zhi · 高艳松 · Abuadbba, Alsharif · Xue, Minhui · 付安民 · 郑宜峰 · Al-Sarawi, Said F. · Abbott, Derek A.
IEEE Transactions on Information Forensics and Security 2023
检测仅依赖预训练特征提取器和相似性比较,用户无需训练模型或理解攻击机制。
运行时仅需一次前向传播提取特征并与少量样本比较相似度,满足实时部署要求。