RGMComm: Return Gap Minimization via Discrete Communications in Multi-Agent Reinforcement Learning
Communication is crucial for solving cooperative Multi-Agent Reinforcement Learning tasks in partially observable Markov Decision Processes. Existing works often rely on black-box methods to encode local information/features into messages shared with other agents, leading to the generation of contin…