Setup 1-step prediction

This commit is contained in:
Shangtong Zhang
2017-12-16 22:14:40 -07:00
parent 214f7693c2
commit f0940e86dc
4 changed files with 154 additions and 2 deletions
+4 -1
View File
@@ -66,7 +66,7 @@ def generate_dateset(game):
env = ClippedRewardsWrapper(env)
ep = 0
max_ep = 10
max_ep = 50
mkdir('dataset/%s' % game)
while True:
rewards, steps = episode(env, agent)
@@ -82,8 +82,11 @@ def generate_dateset(game):
dataset_env.clear_saved()
if ep >= max_ep:
break
with open('dataset/%s/meta.bin' % (game), 'wb') as f:
pickle.dump({'episodes': ep}, f)
if __name__ == '__main__':
mkdir('dataset')
game = 'PongNoFrameskip-v4'
# train_dqn(game)
generate_dateset(game)