2025
AREAL: A Large-Scale Asynchronous Reinforcement Learning System for Language Reasoning
NeurIPS 2025poster
Reinforcement learning (RL) has become a trending paradigm for training large language models (LLMs), particularly for reasoning tasks. Effective RL for LLMs requires massive parallelization and poses an urgent need for efficient training systems. Most existing large-scale RL systems for LLMs are sy…