mirror of
https://github.com/wassname/DeepRL.git
synced 2026-09-09 11:13:47 +08:00
Fix bug
This commit is contained in:
@@ -84,6 +84,7 @@ class AsyncAgent:
|
||||
while True and not self.stop_signal.value:
|
||||
steps, reward = worker.episode()
|
||||
rewards.append(reward)
|
||||
if len(rewards) > 100: rewards.pop(0)
|
||||
self.logger.debug('worker %d, episode %d, return %f, avg return %f, episode steps %d, total steps %d' % (
|
||||
id, episode, rewards[-1], np.mean(rewards[-100:]), steps, self.total_steps.value))
|
||||
|
||||
|
||||
+1
-1
@@ -124,7 +124,7 @@ class DQNAgent:
|
||||
self.logger.info('episode %d, epsilon %f, reward %f, avg reward %f, total steps %d' % (
|
||||
ep, self.policy.epsilon, reward, avg_reward, self.total_steps))
|
||||
|
||||
if ep % self.test_interval == 0:
|
||||
if self.test_repetitions and ep % self.test_interval == 0:
|
||||
self.logger.info('Testing...')
|
||||
self.save('data/%sdqn-model-%s.bin' % (self.tag, self.task.name))
|
||||
test_rewards = []
|
||||
|
||||
Reference in New Issue
Block a user