2026
First-Order Error Matters: Accurate Compensation for Quantized Large Language Models
AAAI 2026technical
Post-training quantization (PTQ) offers an efficient approach to compressing large language models (LLMs), significantly reducing memory access and computational costs. Existing compensation-based weight calibration methods often rely on a second-order Taylor expansion to model quantization error, u