Examens corriges

Dead-ends and Secure Exploration in Reinforcement Learning

Many interesting applications of reinforcement learning (RL) involve MDPs that include numer- ous ?dead-end? states. Upon reaching a dead-end state, the agent ...



Télécharger