2026
Vlaser: Vision-Language-Action Model with Synergistic Embodied Reasoning
ICLR 2026poster
While significant research has focused on developing embodied reasoning capabilities using Vision-Language Models (VLMs) or integrating advanced VLMs into Vision-Language-Action (VLA) models for end-to-end robot control, few studies directly address the critical gap between upstream VLM-based reason…