2025
Text-to-Decision Agent: Offline Meta-Reinforcement Learning from Natural Language Supervision
NeurIPS 2025poster
Offline meta-RL usually tackles generalization by inferring task beliefs from high-quality samples or warmup explorations. The restricted form limits their generality and usability since these supervision signals are expensive and even infeasible to acquire in advance for unseen tasks. Learning dire…