2026
Stochastic Minimum-Cost Reach-Avoid Reinforcement Learning
ICML 2026poster
We study stochastic minimum-cost reach-avoid reinforcement learning, where an agent must satisfy a reach-avoid specification with probability at least $p$ while minimizing expected cumulative costs in stochastic environments. Existing safe and constrained reinforcement learning methods typically fai…