@@ -1 +1,20 @@
这是一个学习强化学习产生的代码
我实现DQN,PG等算法
# DQN
# Policy Gradient
使用下面的命令可以运行已经保存好的模型
‘’‘
python Run_Model.py
'''
使用下面的命令开始训练
pytroch_MountainCar-v0.py
> policyNet.pkl
这个是已经保存好的模型
The note is not visible to the blocked user.