← Search

Anni Zhao

1 accepted papers

2025

Offline Guarded Safe Reinforcement Learning for Medical Treatment Optimization Strategies

NeurIPS 2025spotlight

When applying offline reinforcement learning (RL) in healthcare scenarios, the out-of-distribution (OOD) issues pose significant risks, as inappropriate generalization beyond clinical expertise can result in potentially harmful recommendations. While existing methods like conservative Q-learning (C…

Cited by 0SourceScholar