2026
Risk-Aware Reinforcement Learning with Bandit-Based Adaptation for Quadrupedal Locomotion
ICRA 2026poster
In this work, we introduce a risk-aware reinforcement learning framework for robust quadrupedal locomotion. Our approach first trains a family of risk-conditioned policies using a Conditional Value-at-Risk (CVaR) constrained optimization technique, which improves both training stability and sample e…