Directed Policy Gradient for Safe Reinforcement Learning with Human Advice
 
Directed Policy Gradient for Safe Reinforcement Learning with Human Advice 
 
Helene Plisnier, Helene Plisnier, Denis Steckelmacher, Denis Steckelmacher, Tim Brys, Tim Brys, Diederik Roijers, Diederik Roijers, Ann Nowe, Ann Nowe