Reinforcement LearningPolicy Parameterization for Continuous Actions

ARTICLE

Using a Normal Distribution for Continuous Actions

Loading lesson…