← Search

George D. Konidaris

3 accepted papers

2021

Deep Radial-Basis Value Functions for Continuous Control

AAAI 2021technical

A core operation in reinforcement learning (RL) is finding an action that is optimal with respect to a learned value function. This operation is often challenging when the learned value function takes continuous actions as input. We introduce deep radial-basis value functions (RBVFs): value function…

2021

Visual Transfer For Reinforcement Learning Via Wasserstein Domain Confusion

AAAI 2021technical

We introduce Wasserstein Adversarial Proximal Policy Optimization (WAPPO), a novel algorithm for visual transfer in Reinforcement Learning that explicitly learns to align the distributions of extracted features between a source and target task. WAPPO approximates and minimizes the Wasserstein-1 dist…