A New Pre-Training Paradigm for Offline Multi-Agent Reinforcement Learning with Suboptimal Data
Offline multi-agent reinforcement learning (MARL) with pre-training paradigm, which uses a large quantity of trajectories for offline pre-training and online deployment, has become fashionable lately. While performing well on various tasks, conventional pre-trained decision-making models based on im…