NPU上快13倍
针对NPU和GPU优化的轻量级网络,在人体姿态估计和语义分割任务中实现速度与精度的最佳平衡。
Hao, Zhang · 顿玉洁 · Yixuan, Pei · Lai, Shenqi · Liu, Chengxu · Kaipeng, Zhang · 钱学明
IEEE Transactions on Circuits and Systems for Video Technology 2024
相比Dite-HRNet-30,HF-HRNet-30在NPU上推理速度快约13倍,同时精度还高1.9 AP。
在COCO test-dev上,HF-HRNet-30比Dite-HRNet-30和Lite-HRNet-30分别高1.9 AP和2.8 AP。
采用均匀尺寸模块替代shuffle和动态卷积,避免了对NPU/GPU不友好的操作。