Q_learning 文件夹中的是强化学习Q-learning相关代码 代码主要使用一维迷宫学习Q表的相关知识
DQN 文件夹中的是强化学习DQN算法相关代码 代码主要使用一阶倒立摆学习DQN算法的奖励函数如何设置 代码使用: 使用该文件夹中的train脚本代码,即可进行强化学习训练,训练模型会保存在该文件夹中的dqn_best_model文件夹中(若无此文件夹会自动创建) python train.py #此命令为从最开始训练模型,若一直运行此命令,模型始终是从零开始训练,不会到达最好 python train.py --model [模型名称] #此命令为继续从选择的模型开始训练。每次选择最好的模型,训练效果会越来越好
python visualize_v1.1.py --model [模型名称] #此脚本为可视化查看指定的模型,可以查看模型的效果。