2024
Activation Compression of Graph Neural Networks Using Block-Wise Quantization with Improved Variance Minimization
ICASSP 2024accepted
Efficient training of large-scale graph neural networks (GNNs) has been studied with a specific focus on reducing their memory consumption. Work by Liu et al. (2022) proposed extreme activation compression (EXACT) which demonstrated drastic reduction in memory consumption by performing quantization…