2026
SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization
ICLR 2026poster
Despite advances in pretraining with extended context sizes, large language models (LLMs) still face challenges in effectively utilizing real-world long-context information, primarily due to insufficient long-context alignment caused by data quality issues, training inefficiencies, and the lack of w…