← Search

Xiawei Wu

1 accepted papers

2025

Offline Multi-Agent Reinforcement Learning via In-Sample Sequential Policy Optimization

AAAI 2025technical

Offline Multi-Agent Reinforcement Learning (MARL) is an emerging field that aims to learn optimal multi-agent policies from pre-collected datasets. Compared to single-agent case, multi-agent setting involves a large joint state-action space and coupled behaviors of multiple agents, which bring extra…