2025
Globally Optimal Policy Gradient Algorithms for Reinforcement Learning with PID Control Policies
NeurIPS 2025poster
We develop policy gradient algorithms with global optimality and convergence guarantees for reinforcement learning (RL) with proportional-integral-derivative (PID) parameterized control policies. RL enables learning control policies through direct interaction with a system, without explicit model kn…