Reinforcement LearningExtending Off-Policy Algorithms with Semi-Gradient Methods

ARTICLE

Extending Expected Sarsa Across Multiple Steps

Loading lesson…