2026
Autoencoding-Free Context Compression for LLMs via Contextual Semantic Anchors
ICLR 2026poster
Context compression presents a promising approach for accelerating large language model (LLM) inference by compressing long contexts into compact representations.Current context compression methods predominantly rely on autoencoding tasks to train context-agnostic compression tokens to compress cont…