Leveraging Prior Knowledge in Reinforcement Learning via Double-Sided Bounds on the Value Function

Open in new window