← Search

Kai Liang Tan

1 accepted papers

2022

MDPGT: Momentum-Based Decentralized Policy Gradient Tracking

AAAI 2022technical

We propose a novel policy gradient method for multi-agent reinforcement learning, which leverages two different variance-reduction techniques and does not require large batches over iterations. Specifically, we propose a momentum-based decentralized policy gradient tracking (MDPGT) where a new momen…