模型体积降27.7倍
在保持合理精度的前提下,将ViT的权重二值化并优化注意力计算,大幅压缩模型体积并减少计算开销。
王妙辉 · Xu, Zhuowei · Bin, Zheng · Xie, Wuyuan
IEEE Transactions on Industrial Informatics 2024
权重从32位量化到1位,并配合分层自适应架构,模型体积平均缩小27.7倍。
在实现大幅压缩和计算节省的同时,仍保持合理的准确率。