LRMP:DNN

Abinand Nallathambi1, Christin David Bose1, Wilfried Haensch2

  • 1Elmore Family School of Electrical and Computer Engineering, Purdue University, West Lafayette, IN, United States.

概括

我们介绍了LRMP,该方法结合了层复制和混合精度量化,以提高内存计算 (IMC) 加速器上的深度神经网络 (DNN) 性能. 这种方法显著降低了延迟,并增加了DNN的吞吐量,以最小的准确性损失.