Continuous Control: learning the optimal policy in a continuous action space

Continuous Control: learning the optimal policy in a continuous action space