2026
MemDecoder: Enhancing Test-Time Compute for LLM Agents via Reinforced Memory Decoding
ICML 2026poster
Agentic memory—conditioning large language and vision–language models on past cases, external knowledge, or meta‑experiences—has become a key mechanism for improving inference‑time reasoning. However, existing approaches largely rely on heuristic retrieval or expensive LLM‑based reranking, and do no…