暂存需求降幅显著
该宏单元通过比特级松耦合计算方案,将临时数据的位宽降至1比特,显著节省寄存器资源,并结合零检测与提前终止方案提升能效与计算精度。
Junchuan, Gu · Yang, Chen · Wenwei, Wang · Kumar, Akash · Ullah, Salim · 黄科杰 · 沈海斌
Microelectronics Journal 2025
采用比特级松耦合计算方案,将临时数据的位宽降到1比特,从而大幅节省寄存器资源。
相比于8-bit量化模型,在AlexNet和ResNet20(CIFAR-10数据集)上分别仅产生0.29%和0.52%的精度损失。
在40-nm工艺下,该存内计算宏的功耗为3.54 mW,计算功耗比达到37.01 TOPS/W。