2025
Is PRM Necessary? Problem-Solving RL Implicitly Induces PRM Capability in LLMs
NeurIPS 2025poster
The development of reasoning capabilities represents a critical frontier in large language models (LLMs) research, where reinforcement learning (RL) and process reward models (PRMs) have emerged as predominant methodological frameworks. Contrary to conventional wisdom, empirical evidence from DeepSe…