← Search

Zhenxuan Yu

1 accepted papers

2025

Slender-Mamba: Fully Quantized Mamba in 1.58 Bits From Head to Toe

COLING 2025main

Large language models (LLMs) have achieved significant performance improvements in natural language processing (NLP) domain. However, these models often require large computational resources for training and inference. Recently, Mamba, a language model architecture based on State-Space Models (SSMs)…

Cited by 1SourcePDFScholar