Eduardo Lobo Lustosa Cabral1, Larissa Driemeier2

  • 1Institute for Energy and Nuclear Research and Mauá Institute of Technology, São Paulo, SP, Brazil.

概括

减少神经网络模型大小是提高效率的关键. 这项研究表明,更低的比特精度 (低至2.32位) 保持了性能,使其能够在内存受限的设备上使用.