[rllib] Support the timesteps_per_batch in simple optimizer PPO mode (#2558)

* support ts

* doc

* Update sync_samples_optimizer.py
This commit is contained in:
Eric Liang
2018-08-06 12:10:59 -07:00
committed by GitHub
parent 9015e742c4
commit 981d9818c1
3 changed files with 17 additions and 9 deletions
+4 -2
View File
@@ -83,8 +83,10 @@ class PPOAgent(Agent):
})
if self.config["simple_optimizer"]:
self.optimizer = SyncSamplesOptimizer(
self.local_evaluator, self.remote_evaluators,
{"num_sgd_iter": self.config["num_sgd_iter"]})
self.local_evaluator, self.remote_evaluators, {
"num_sgd_iter": self.config["num_sgd_iter"],
"timesteps_per_batch": self.config["timesteps_per_batch"]
})
else:
self.optimizer = LocalMultiGPUOptimizer(
self.local_evaluator, self.remote_evaluators, {