2025
SWE-smith: Scaling Data for Software Engineering Agents
NeurIPS 2025spotlight
Despite recent progress in Language Models (LMs) for software engineering, collecting training data remains a significant pain point. Existing datasets are small, with at most 1,000s of training instances from 11 or fewer GitHub repositories. The procedures to curate such datasets are often complex,…