2026
LampQ: Towards Accurate Layer-wise Mixed Precision Quantization for Vision Transformers
AAAI 2026technical
How can we accurately quantize a pre-trained Vision Transformer model? Quantization algorithms compress Vision Transformers (ViTs) into low-bit formats, reducing memory and computation demands with minimal accuracy degradation. However, existing methods rely on uniform precision, ignoring the divers