2026
Steerable Vision-Language-Action Policies for Embodied Reasoning and Hierarchical Control
RSS 2026poster
Pretrained vision-language models (VLMs) can make semantic and visual inferences across diverse settings, providing valuable common-sense priors for robotic control. However, effectively grounding this knowledge in robot behaviors remains an open challenge. Prior methods often employ a hierarchical …