diff --git a/readme.md b/readme.md index eae53aa..7a720cd 100644 --- a/readme.md +++ b/readme.md @@ -1 +1,20 @@ 这是一个学习强化学习产生的代码 +我实现DQN,PG等算法 + +# DQN + +# Policy Gradient + +使用下面的命令可以运行已经保存好的模型 +‘’‘ +python Run_Model.py +''' + +使用下面的命令开始训练 +''' +pytroch_MountainCar-v0.py +''' + + +> policyNet.pkl +这个是已经保存好的模型