← Search

Juan Rocamonde

1 accepted papers

2024

Vision-Language Models are Zero-Shot Reward Models for Reinforcement Learning

ICLR 2024poster

Reinforcement learning (RL) requires either manually specifying a reward function, which is often infeasible, or learning a reward model from a large amount of human feedback, which is often very expensive. We study a more sample-efficient alternative: using pretrained vision-language models (VLMs)…