2026
Towards Complete Multi-Agent Coordination Policy Learning via Denoising Maximum Entropy Optimization
ICML 2026poster
Parameter sharing is a widely used technique in Multi-Agent Reinforcement Learning (MARL) that enhances sample efficiency by equipping agents with a unified policy. While effective in homogeneous settings, it often struggles in heterogeneous environments where agents possess diverse capabilities. Co…