← Search

Xuedong He

2 accepted papers

2023

Regret Bounds for Markov Decision Processes with Recursive Optimized Certainty Equivalents

ICML 2023poster

The optimized certainty equivalent (OCE) is a family of risk measures that cover important examples such as entropic risk, conditional value-at-risk and mean-variance models. In this paper, we propose a new episodic risk-sensitive reinforcement learning formulation based on tabular Markov decision p…

Cited by 13SourcePDFScholar