← Search

Toussaint Marc

1 accepted papers

2017

Optimizing Long-term Predictions for Model-based Policy Search

CoRL 2017

We propose a novel long-term optimization criterion to improve the robustness of model-based reinforcement learning in real-world scenarios. Learning a dynamics model to derive a solution promises much greater data-efficiency and reusability compared to model-free alternatives. In practice, however,