2025
Fine-Grained Preference Optimization Improves Spatial Reasoning in VLMs
NeurIPS 2025poster
Current Vision-Language Models (VLMs) struggle with fine-grained spatial reasoning, particularly when multi-step logic and precise spatial alignment are required. In this work, we introduce SpatialReasoner-R1, a vision-language reasoning model designed to address these limitations. To construct high…