2025
Revisiting Reinforcement Learning for LLM Reasoning from A Cross-Domain Perspective
NeurIPS 2025poster
Reinforcement learning (RL) has shown promise in enhancing large language model (LLM) reasoning, yet progress towards broader capabilities is limited by the availability of high-quality, multi-domain datasets. This work introduces \ours, a 92K RL-for-reasoning dataset designed to address this gap, c…