← Search

Stephen Youn

1 accepted papers

2024

Exploring Post-training Quantization in LLMs from Comprehensive Study to Low Rank Compensation

AAAI 2024technical

Post-training quantization (PTQ) has emerged as a promising technique for mitigating memory consumption and computational costs in large language models (LLMs). However, a systematic examination of various quantization schemes, model families, and quantization bit precision has been absent from the…

Cited by 25SourcePDFScholar