mirror of
https://github.com/wassname/DeepRL.git
synced 2026-09-09 11:13:47 +08:00
Major update
This commit is contained in:
+1
-1
@@ -1,6 +1,6 @@
|
||||
from .config import *
|
||||
from .normalizer import *
|
||||
from .run import *
|
||||
from .misc import *
|
||||
|
||||
try:
|
||||
from .tf_logger import Logger
|
||||
|
||||
@@ -48,3 +48,4 @@ class Config:
|
||||
self.min_epsilon = 0
|
||||
self.save_interval = 0
|
||||
self.max_steps = 0
|
||||
self.success_threshold = float('inf')
|
||||
|
||||
@@ -50,4 +50,8 @@ def run_episodes(agent):
|
||||
if avg_reward > agent.task.success_threshold:
|
||||
break
|
||||
|
||||
return steps, rewards, avg_test_rewards
|
||||
return steps, rewards, avg_test_rewards
|
||||
|
||||
def sync_grad(target_network, src_network):
|
||||
for param, src_param in zip(target_network.parameters(), src_network.parameters()):
|
||||
param._grad = src_param.grad.clone()
|
||||
Reference in New Issue
Block a user