Mike Clark
9b7d21a0f2
load and save for SharedReplay
...
Not sure if your interested in adding this, it just supports saving and loading SharedReplay. For example if you want to load previous DDPG experience.
2018-02-02 15:11:44 +08:00
Shangtong Zhang
964734755f
Expose original Atari game reward
2017-12-23 20:52:17 -07:00
Shangtong Zhang
214f7693c2
Generate dataset for video prediction
2017-12-16 20:03:11 -07:00
Shangtong Zhang
8c197e183c
Support D3PG
2017-11-11 19:41:52 -07:00
Shangtong Zhang
edc4e89b9b
Update DDPG
2017-11-11 15:27:06 -07:00
Shangtong Zhang
41627588fb
Action dim
2017-11-09 16:38:42 -07:00
Shangtong Zhang
a59f2d2911
Benchmark DDPG with Roboschool
2017-10-27 23:09:24 -06:00
Shangtong Zhang
af360bb9ea
Support roboschool
2017-10-27 14:23:54 -06:00
Shangtong Zhang
6682937b54
Support python3 and pytorch 0.2
2017-10-26 23:01:57 -06:00
Shangtong Zhang
1b6de16b4f
Fix a critical bug in DDPG
2017-10-15 10:05:33 -06:00
Shangtong Zhang
c5cbc10f94
Refactor DDPG
2017-10-06 11:16:21 -06:00
Shangtong Zhang
e58938e3fe
Support async PPO, which doesn't work
2017-10-04 22:33:26 -06:00
Shangtong Zhang
27f54ed420
Single thread PPO
2017-10-04 09:33:35 -06:00
Shangtong Zhang
e60e9feecb
Refactor for HRA
2017-08-29 22:10:13 -06:00
Shangtong Zhang
d52182882a
Implementation of hybrid reward architecture
2017-08-29 21:52:26 -06:00
Shangtong Zhang
5116733f22
DDPG Pendulum
2017-08-01 10:52:14 -06:00
Shangtong Zhang
1be3b44999
Continuous A3C
2017-07-31 22:53:09 -06:00
Shangtong Zhang
ce504e2d0f
Major refactor
2017-07-26 18:18:49 -06:00