分层自适应二值ViT

模型体积降27.7倍

在保持合理精度的前提下,将ViT的权重二值化并优化注意力计算,大幅压缩模型体积并减少计算开销。

王妙辉 · Xu, Zhuowei · Bin, Zheng · Xie, Wuyuan

IEEE Transactions on Industrial Informatics 2024

参数信息

模型体积减小倍数
27.7 ×

技术优势

模型体积锐减

权重从32位量化到1位,并配合分层自适应架构,模型体积平均缩小27.7倍。

精度保持合理

在实现大幅压缩和计算节省的同时,仍保持合理的准确率。

应用场景