18 Commits
Author SHA1 Message Date
Mike Clark 9b7d21a0f2 load and save for SharedReplay
Not sure if your interested in adding this, it just supports saving and loading SharedReplay. For example if you want to load previous DDPG experience.
2018-02-02 15:11:44 +08:00
Shangtong Zhang 964734755f Expose original Atari game reward 2017-12-23 20:52:17 -07:00
Shangtong Zhang 214f7693c2 Generate dataset for video prediction 2017-12-16 20:03:11 -07:00
Shangtong Zhang 8c197e183c Support D3PG 2017-11-11 19:41:52 -07:00
Shangtong Zhang edc4e89b9b Update DDPG 2017-11-11 15:27:06 -07:00
Shangtong Zhang 41627588fb Action dim 2017-11-09 16:38:42 -07:00
Shangtong Zhang a59f2d2911 Benchmark DDPG with Roboschool 2017-10-27 23:09:24 -06:00
Shangtong Zhang af360bb9ea Support roboschool 2017-10-27 14:23:54 -06:00
Shangtong Zhang 6682937b54 Support python3 and pytorch 0.2 2017-10-26 23:01:57 -06:00
Shangtong Zhang 1b6de16b4f Fix a critical bug in DDPG 2017-10-15 10:05:33 -06:00
Shangtong Zhang c5cbc10f94 Refactor DDPG 2017-10-06 11:16:21 -06:00
Shangtong Zhang e58938e3fe Support async PPO, which doesn't work 2017-10-04 22:33:26 -06:00
Shangtong Zhang 27f54ed420 Single thread PPO 2017-10-04 09:33:35 -06:00
Shangtong Zhang e60e9feecb Refactor for HRA 2017-08-29 22:10:13 -06:00
Shangtong Zhang d52182882a Implementation of hybrid reward architecture 2017-08-29 21:52:26 -06:00
Shangtong Zhang 5116733f22 DDPG Pendulum 2017-08-01 10:52:14 -06:00
Shangtong Zhang 1be3b44999 Continuous A3C 2017-07-31 22:53:09 -06:00
Shangtong Zhang ce504e2d0f Major refactor 2017-07-26 18:18:49 -06:00