2024
Phasic Diversity Optimization for Population-Based Reinforcement Learning
ICRA 2024poster
Reviewing the previous work of diversity Reinforcement Learning, diversity is often obtained via an augmented loss function, which requires a balance between reward and diversity. Generally, diversity optimization algorithms use Multi-armed Bandits algorithms to select the coefficient in the pre-def…