[rllib] Do not store torch tensors when using grad clipping (#8509)

This commit is contained in:
Tomasz Wrona
2020-05-28 12:06:27 -07:00
committed by GitHub
parent 99cc2e28b3
commit f266318a01
+4 -1
View File
@@ -64,8 +64,11 @@ def apply_grad_clipping(policy, optimizer, loss):
params = list(
filter(lambda p: p.grad is not None, param_group["params"]))
if params:
info["grad_gnorm"] = nn.utils.clip_grad_norm_(
grad_gnorm = nn.utils.clip_grad_norm_(
params, policy.config["grad_clip"])
if isinstance(grad_gnorm, torch.Tensor):
grad_gnorm = grad_gnorm.cpu().numpy()
info["grad_gnorm"] = grad_gnorm
return info