← Search

Haowen Dou

2 accepted papers

2026

Gradient-Protected Value Decomposition for Cooperative Multi-Agent Reinforcement Learning

AAAI 2026technical

In recent years, deep multi-agent reinforcement learning (MARL) has demonstrated remarkable potential in solving complex cooperative tasks by enabling decentralized yet efficient coordination among agents. However, during decentralized training, agent policy updates induced by different joint action

Cited by 0SourcePDFScholar
2024

Measuring Mutual Policy Divergence for Multi-Agent Sequential Exploration

NeurIPS 2024poster

Despite the success of Multi-Agent Reinforcement Learning (MARL) algorithms in cooperative tasks, previous works, unfortunately, face challenges in heterogeneous scenarios since they simply disable parameter sharing for agent specialization. Sequential updating scheme was thus proposed, naturally di…