← Search

Yifei Wei

1 accepted papers

2026

ACoT-VLA: Action Chain-of-Thought for Vision-Language-Action Models

CVPR 2026

Vision-Language-Action models have emerged as essential generalist robot policies for diverse manipulation tasks, conventionally relying on directly translating multimodal inputs into actions via Vision-Language Model embeddings. Recent advancements have introduced explicit intermediary reasoning--s

Cited by 0SourcecodeScholar