轻量视觉Transformer模型

手机端识别不卡顿

仅0.48M参数量的轻量级ViT,在脱机手写体汉字识别上达到95.8%准确率,可直接部署于移动端。

Shiyong, Geng · Zhu, Zongnan · Zhida, Wang · 但永平 · Li, Hengyi

Electronics (Switzerland) 2023

参数信息

参数数量
0.48 M
FLOPs
0.22 G
识别准确率
95.8 %
参数减少比例(相对MobileViT)
53.8 %
FLOPs减少比例(相对MobileViT)
18.5 %

技术优势

参数更少

相比 MobileViT,参数减少了 53.8%,模型体积大幅缩小,更适合移动端部署。

计算更省

FLOPs 减少 18.5%,推理速度更快,功耗更低,延长移动设备续航。

精度不降

在参数和 FLOPs 大幅降低的同时,识别准确率达到 95.8%,证明轻量化设计没有牺牲性能。

应用场景