2021
Towards Unifying Behavioral and Response Diversity for Open-ended Learning in Zero-sum Games
NeurIPS 2021poster
Measuring and promoting policy diversity is critical for solving games with strong non-transitive dynamics where strategic cycles exist, and there is no consistent winner (e.g., Rock-Paper-Scissors). With that in mind, maintaining a pool of diverse policies via open-ended learning is an attractive s…