2018-10-22 10:50:17 +08:00
2018-10-18 16:51:16 +08:00
2018-10-10 16:17:53 +08:00
2018-10-22 10:50:17 +08:00
2018-08-18 16:54:37 +08:00
2018-08-10 10:03:30 +08:00
2018-10-08 10:02:12 +08:00
2018-07-10 11:47:11 +08:00
2018-08-07 10:54:21 +08:00
2018-10-22 10:48:03 +08:00
2018-07-30 10:43:24 +08:00
2018-07-27 14:00:20 +08:00

这是一个学习强化学习产生的代码 我实现DQN,PG等算法

DQN

包含两个算法

Policy Gradient

使用下面的命令可以运行已经保存好的模型

python Run_Model.py

使用下面的命令开始训练

pytorch_MountainCar-v0.py

policyNet.pkl

这个是已经保存好的模型

Alphago zero

我将在兵棋游戏中复现alphago zero

欢迎关注中科院自动化所智能系统与工程中心

Actor-Critic

S
Description
PyTorch implementation of DQN, AC, ACER, A2C, A3C, PG, DDPG, TRPO, PPO, SAC, TD3 and ....
Readme MIT
43 MiB
Languages
Python 100%