Baxter, JonBartlett, Peter2015-12-082015-12-08May 28 2000780354826http://hdl.handle.net/1885/28851Direct Gradient-based Reinforcement Learning20002015-12-08