Reinforcement LearningREINFORCE with Baseline: Reducing Variance in Policy Gradient Methods

ARTICLE

Choosing a Baseline in REINFORCE

Loading lesson…