2025
Simultaneous Statistical Inference for Off-Policy Evaluation in Reinforcement Learning
NeurIPS 2025poster
This work presents the first theoretically justified simultaneous inference framework for off-policy evaluation (OPE). In contrast to existing methods that focus on point estimates or pointwise confidence intervals (CIs), the new framework quantifies global uncertainty across an infinite or continuo…