2026
Comparing Deterministic and Soft Policy Gradients for Optimizing Gaussian Mixture Actors
ICML 2026poster
Gaussian Mixture Models (GMMs) have been recently proposed for approximating actors in actor-critic reinforcement learning algorithms. Such GMM-based actors are commonly optimized using stochastic policy gradients along with an entropy maximization objective. In contrast to previous work, we define …