← Search

Sebastien Gros

2 accepted papers

2025

Offline Guarded Safe Reinforcement Learning for Medical Treatment Optimization Strategies

NeurIPS 2025spotlight

When applying offline reinforcement learning (RL) in healthcare scenarios, the out-of-distribution (OOD) issues pose significant risks, as inappropriate generalization beyond clinical expertise can result in potentially harmful recommendations. While existing methods like conservative Q-learning (C…

Cited by 0SourceScholar
2024

Flipping-based Policy for Chance-Constrained Markov Decision Processes

NeurIPS 2024poster

Safe reinforcement learning (RL) is a promising approach for many real-world decision-making problems where ensuring safety is a critical necessity. In safe RL research, while expected cumulative safety constraints (ECSCs) are typically the first choices, chance constraints are often more pragmatic…

Cited by 1SourcePDFScholar