Courses
Concepts
Explore
Playground
Practice
Log in
Course contents
← Back to course
Reinforcement Learning
You are in chapter 72
0% of course complete
72
Q-learning: Mastering Off-Policy TD Control
Module 1 · Q-learning Algorithm and Backup Diagram
→
ARTICLE
Reading the Q-learning Backup Diagram
›
Reinforcement Learning
›
Q-learning: Mastering Off-Policy TD Control
ARTICLE
Reading the Q-learning Backup Diagram
Loading lesson…
← PREVIOUS
How Q-learning Revises Its Action Values
MARK COMPLETE ✓
NEXT →
Cliff-walking: Seeing the Difference Between Sarsa and Q-learning