From 6f029acf4783136a2dfc8c2ea6ea51d6a9b05144 Mon Sep 17 00:00:00 2001 From: Shangtong Zhang Date: Fri, 18 May 2018 15:44:46 -0600 Subject: [PATCH] Tune params --- deep_rl/agent/DDPG_agent.py | 2 ++ 1 file changed, 2 insertions(+) diff --git a/deep_rl/agent/DDPG_agent.py b/deep_rl/agent/DDPG_agent.py index bf8f143..ead45ac 100644 --- a/deep_rl/agent/DDPG_agent.py +++ b/deep_rl/agent/DDPG_agent.py @@ -7,6 +7,7 @@ from ..network import * from ..component import * from .BaseAgent import * +import torchvision class DDPGAgent(BaseAgent): def __init__(self, config): @@ -47,6 +48,7 @@ class DDPGAgent(BaseAgent): if not deterministic: action += self.random_process.sample() next_state, reward, done, info = self.task.step(action) + # torchvision.utils.save_image(torch.tensor(np.asarray(next_state)).unsqueeze(1), 'data/image/%s.png' % get_time_str()) next_state = self.config.state_normalizer(next_state) total_reward += reward reward = self.config.reward_normalizer(reward)