VQ4SNN: Vector Quantization for Memory-Efficient FPGA Spiking Neural Networks
Researchers propose VQ4SNN, a hardware-efficient architecture that uses vector quantization to reduce memory requirements for spiking neural networks on FPGAs by 52-61% without sacrificing inference accuracy. This innovation addresses a critical bottleneck in deploying dense SNNs on edge hardware, combining weight-sharing techniques with FPGA-aware memory optimization.