Two-step reinforcement learning for model-free redesign of nonlinear optimal regulator

Open in new window