


【内容简介】
《强化学习设计器简明版使用与MATLAB程序详解视频》共4章16节视频,总学时137分钟,合2.3小时。该课程可以快速了解【深度强化学习】包含哪些知识,可以怎样快速地学习与应用【深度强化学习】算法求解自己的问题。
主要内容包括:强化学习设计器一系列视频课程包含哪些内容和可以解决哪些问题,创建环境和创建智能体及超参数设置,训练智能体操作及训练参数设置,仿真测试智能体及测试参数设置与接续训练及仿真。
全部免费提供MATLAB代码程序和PPT课件。免费提供辅导答疑。
【前期基础】衔接课程
无。
【后期选学】相关课程推荐:
(1)《车杆平衡系统及双积分系统控制问题分别利用MATLAB环境和Simulink环境用DQN和PPO智能体训练仿真操作》
(2)《四足机器人行走控制问题利用Simulink环境及DDPG和TD3智能体训练仿真操作》
【强化学习算法视频课程】推荐
(1) 强化学习设计器使用与MATLAB程序详解视频;
(2) 如何创建强化学习问题的MATLAB环境及程序详解视频;
(3) 如何创建强化学习问题的Simulink环境及程序详解视频;
(4) 强化学习(RL)及其应用与MATLAB程序详解视频;(5) 深度强化学习(DRL)及其应用与MATLAB程序详解视频。
一、学习指导方案
1、全部视频都在网上。请首先按照视频文件序号由小到大(若前序号相同,说明视频内容密切联系,再看后面序号大小)的序号观看,保证内容由浅入深地顺序学习。
2、在看视频的同时,利用【倍速】【暂停】【倒回】操作,最好运行程序文件。
3、将存在的问题记录下来,看看视频是否讲解。对视频还是没有讲解的问题,尽快问【面对面数学】答疑。
4、视频观看结束后,看看PPT课件,复习、巩固学习效果。
5、视频清晰度:(1)建议屏幕分辨率设置为1920x1080 或者屏幕分辨率1280x720。(2)全屏播放。这样看视频更加清晰。
6、倍速播放:现在【淘宝新平台】已经具备【倍速播放】视频功能。
四、目 录
第一章 视频课程内容介绍及慎拍不拍说明与参考文献(25-6分钟)
0、先看全面讲解9个关键重点问题和店主预言先告必看第三版(38+4分钟)
1、RLD1_1视频讲些什么内容及能干什么说明(11-6分钟,网络上免费“试看”)
2、RLD1_2MATLAB程序免费提供及课程亮点特点说明(3分钟,网络上免费“试看”)
3、RLD1_3慎拍不拍建议与学习基础要求及参考文献(7分钟,网络上免费“试看”)
4、RLD1_4教学顾虑及教与学对策建议(4分钟,网络上免费“试看”)
第二章 创建环境和创建智能体及超参数设置(62分钟)
5、RLD2-1学习强化学习设计器的目的与作用(7分钟)
6、RLD2-2设计器的基本框架及功能讲解(4分钟,网络上免费“试看”)
7、RLD2-3新创建环境与导入自己问题的环境(9钟,有程序)
8、RLD2-4新创建智能体及其超参数基本设置(9分钟,有程序)
9、RLD2-5智能体参数及双Q学习法与目标更新频率(8分钟)
10、RLD2-6Actor和Critic及其参数设置(11分钟)
11、RLD2-7ε-贪婪策略及其衰减率设置(7分钟)
12、RLD2-8OU随机噪声及其衰减率设置(7分钟)
第三章 训练智能体操作及训练参数设置(34分钟)
14、RLD3-1深度强化学习全部参数解读及训练智能体操作(12分钟)
15、RLD3-2训练参数设置及训练进程解读与分析(12分钟)
16、RLD3-3训练进程解读及预训练智能体保存(10分钟)
第四章 仿真测试智能体及测试参数设置(20分钟)
17、RLD4-1保存当前会话结果及仿真测试经验介绍(10分钟)
18、RLD4-2仿真参数设置及仿真测试结果解读分析(10分钟)
第五章 数据检查器操作及保存训练进程和仿真结果图像(39分钟)
19、RLD5-1训练进程图像保存及训练程序生成(12分钟,有程序)
20、RLD5-2仿真测试图像保存及测试程序生成(12分钟,有程序)
21、RLD5-3数据检查器简介及绘制回合6个子图(7分钟)
22、RLD5-4仿真测试图像和数据保存及比较操作(8分钟)
第六章 车杆平衡系统控制问题利用Simulink环境和DQN智能体训练仿真(33分钟)
23、RLD6-1目标要求及两类环境特点与六个智能体特点(6分钟,,网络上免费“试看”)
24、RLD6-2车杆平衡控制问题简介及设计器操作安排思路(6分钟,有程序)
25、RLD6-3新创建Simulink环境与DQN智能体及训练出错(7分钟,有程序)
26、RLD6-4纠错过程及2处改正到程序正常运行(5分钟,有程序)
27、RLD6-5训练失败到正常及3个结果保存(9分钟,有程序)
第七章 双积分系统控制问题利用MATLAB环境和PPO智能体训练仿真(31分钟)
28、RLD7-1双积分系统控制问题简介及设计器操作安排思路(7分钟,有程序)
29、RLD7-2新创建MATLAB环境与PPO智能体及参数设置(9分钟,有程序)
30、RLD7-3训练参数设置及停止条件(7分钟,有程序,网络上免费“试看”)
31、RLD7-4训练与仿真第2和第3方案及过程分析(8分钟,有程序)
第八章 四足机器人行走控制问题利用Simulink环境和DDPG智能体训练仿真(31分钟)
32、RLD8-1四足机器人快速行走控制问题简介及设计器操作思路(10分钟,有程序)
33、RLD8-2导入Simulink环境与导入DDPG智能体及参数设置(11分钟,有程序)
34、RLD8-3训练与仿真DDPG智能体过程分析及结果保存(10分钟,有程序)
第九章 四足机器人行走控制问题利用Simulink环境和TD3智能体训练仿真(47分钟)
35、RLD9-1TD3算法操作安排思路及运行自编程序再导入环境(8分钟,有程序)
36、RLD9-2创建TD3智能体及超参数设置解读与保存(6分钟,有程序,网络上免费“试看”)
37、RLD9-3训练TD3智能体和过程解读分析及机器人表现(11分钟,有程序)
38、RLD9-4训练与仿真TD3智能体过程分析及3个结果保存(10分钟,有程序)
39、RLD9-5训练与仿真3次继续或恢复等综合操作解读(12分钟,有程序)
五、下载文件
1、必先看_强化学习设计器使用及MATLAB程序视频学习指导.doc
2、RLD_PPT课件.rar
3、RLD_m.rar



