← Search

Vitchyr Pong*

1 accepted papers

2018

Temporal Difference Models: Model-Free Deep RL for Model-Based Control

ICLR 2018poster

Model-free reinforcement learning (RL) has been proven to be a powerful, general tool for learning complex behaviors. However, its sample efficiency is often impractically large for solving challenging real-world problems, even for off-policy algorithms such as Q-learning. A limiting factor in class…

Cited by 325SourcePDFScholar