课程封面

强化学习设计器(RLD)使用与MATLAB程序详解视频教程

共18节 已有0人学过

主讲老师zhengyi

更新时间2025-06-25 18:50:34

课件资料暂无

28

加载中...

课程介绍

【内容简介】

《强化学习设计器简明版使用与MATLAB程序详解视频》共4章16节视频,总学时137分钟,合2.3小时。该课程可以快速了解【深度强化学习】包含哪些知识,可以怎样快速地学习与应用【深度强化学习】算法求解自己的问题

主要内容包括:强化学习设计器一系列视频课程包含哪些内容和可以解决哪些问题,创建环境和创建智能体及超参数设置,训练智能体操作及训练参数设置,仿真测试智能体及测试参数设置与接续训练及仿真。

全部免费提供MATLAB代码程序和PPT课件。免费提供辅导答疑

【前期基础】衔接课程

无。

后期选学】相关课程推荐:

(1)《车杆平衡系统及双积分系统控制问题分别利用MATLAB环境和Simulink环境用DQN和PPO智能体训练仿真操作》

(2)《四足机器人行走控制问题利用Simulink环境及DDPG和TD3智能体训练仿真操作》

【强化学习算法视频课程】推荐

(1) 强化学习设计器使用与MATLAB程序详解视频;

(2) 如何创建强化学习问题的MATLAB环境及程序详解视频;

(3) 如何创建强化学习问题的Simulink环境及程序详解视频;

(4) 强化学习(RL)及其应用与MATLAB程序详解视频;(5) 深度强化学习(DRL)及其应用与MATLAB程序详解视频。

一、学习指导方案

1、全部视频都在网上。请首先按照视频文件序号由小到大(若前序号相同,说明视频内容密切联系,再看后面序号大小)的序号观看,保证内容由浅入深地顺序学习。

2、在看视频的同时,利用【倍速】【暂停】【倒回】操作,最好运行程序文件。

3、将存在的问题记录下来,看看视频是否讲解。对视频还是没有讲解的问题,尽快问【面对面数学】答疑。

4、视频观看结束后,看看PPT课件,复习、巩固学习效果。

5、视频清晰度:(1)建议屏幕分辨率设置为1920x1080 或者屏幕分辨率1280x720。(2)全屏播放。这样看视频更加清晰。

6、倍速播放:现在【淘宝新平台】已经具备【倍速播放】视频功能。

四、目  录

第一章  视频课程内容介绍及慎拍不拍说明与参考文献(25-6分钟)

0、先看全面讲解9个关键重点问题和店主预言先告必看第三版(38+4分钟)

1、RLD1_1视频讲些什么内容及能干什么说明(11-6分钟,网络上免费“试看”)

2、RLD1_2MATLAB程序免费提供及课程亮点特点说明(3分钟,网络上免费“试看”)

3、RLD1_3慎拍不拍建议与学习基础要求及参考文献(7分钟,网络上免费“试看”)

4、RLD1_4教学顾虑及教与学对策建议(4分钟,网络上免费“试看”)

第二章  创建环境和创建智能体及超参数设置(62分钟)

5、RLD2-1学习强化学习设计器的目的与作用(7分钟)

6、RLD2-2设计器的基本框架及功能讲解(4分钟,网络上免费“试看”)

7、RLD2-3新创建环境与导入自己问题的环境(9钟,有程序)

8、RLD2-4新创建智能体及其超参数基本设置(9分钟,有程序)

9、RLD2-5智能体参数及双Q学习法与目标更新频率(8分钟)

10、RLD2-6Actor和Critic及其参数设置(11分钟)

11、RLD2-7ε-贪婪策略及其衰减率设置(7分钟)

12、RLD2-8OU随机噪声及其衰减率设置(7分钟)

第三章  训练智能体操作及训练参数设置(34分钟)

14、RLD3-1深度强化学习全部参数解读及训练智能体操作(12分钟)

15、RLD3-2训练参数设置及训练进程解读与分析(12分钟)

16、RLD3-3训练进程解读及预训练智能体保存(10分钟)

第四章  仿真测试智能体及测试参数设置(20分钟)

17、RLD4-1保存当前会话结果及仿真测试经验介绍(10分钟)

18、RLD4-2仿真参数设置及仿真测试结果解读分析(10分钟)

第五章  数据检查器操作及保存训练进程和仿真结果图像(39分钟)

19、RLD5-1训练进程图像保存及训练程序生成(12分钟,有程序)

20、RLD5-2仿真测试图像保存及测试程序生成(12分钟,有程序)

21、RLD5-3数据检查器简介及绘制回合6个子图(7分钟)

22、RLD5-4仿真测试图像和数据保存及比较操作(8分钟)

第六章  车杆平衡系统控制问题利用Simulink环境和DQN智能体训练仿真(33分钟)

23、RLD6-1目标要求及两类环境特点与六个智能体特点(6分钟,,网络上免费“试看”)

24、RLD6-2车杆平衡控制问题简介及设计器操作安排思路(6分钟,有程序)

25、RLD6-3新创建Simulink环境与DQN智能体及训练出错(7分钟,有程序)

26、RLD6-4纠错过程及2处改正到程序正常运行(5分钟,有程序)

27、RLD6-5训练失败到正常及3个结果保存(9分钟,有程序)

第七章  双积分系统控制问题利用MATLAB环境和PPO智能体训练仿真(31分钟)

28、RLD7-1双积分系统控制问题简介及设计器操作安排思路(7分钟,有程序)

29、RLD7-2新创建MATLAB环境与PPO智能体及参数设置(9分钟,有程序)

30、RLD7-3训练参数设置及停止条件(7分钟,有程序,网络上免费“试看”)

31、RLD7-4训练与仿真第2和第3方案及过程分析(8分钟,有程序)

第八章  四足机器人行走控制问题利用Simulink环境和DDPG智能体训练仿真(31分钟)

32、RLD8-1四足机器人快速行走控制问题简介及设计器操作思路(10分钟,有程序)

33、RLD8-2导入Simulink环境与导入DDPG智能体及参数设置(11分钟,有程序)

34、RLD8-3训练与仿真DDPG智能体过程分析及结果保存(10分钟,有程序)

第九章  四足机器人行走控制问题利用Simulink环境和TD3智能体训练仿真(47分钟)

35、RLD9-1TD3算法操作安排思路及运行自编程序再导入环境(8分钟,有程序)

36、RLD9-2创建TD3智能体及超参数设置解读与保存(6分钟,有程序,网络上免费“试看”)

37、RLD9-3训练TD3智能体和过程解读分析及机器人表现(11分钟,有程序)

38、RLD9-4训练与仿真TD3智能体过程分析及3个结果保存(10分钟,有程序)

39、RLD9-5训练与仿真3次继续或恢复等综合操作解读(12分钟,有程序)

五、下载文件

1、必先看_强化学习设计器使用及MATLAB程序视频学习指导.doc

2、RLD_PPT课件.rar

3、RLD_m.rar

讲师介绍

讲师头像

zhengyi

郑一,青岛高校退休多年,三级数学专业教授,硕士研究生导师。在职期间主讲本科生课程、研究生课程多门,主编《概率论与数理统计》等教材及学习指导书7部。讲授强化学习和深度强化学习、卷积神经网络和长短时记忆网络、信号分析与处理算法、图像分析与处理算法、遗传算法、粒子群优化算法以及两个算法融合等30多门算法视频课程,算法课程远销台湾、香港、英国、德国和美国等地区或国家,深受网友们和学子们的喜爱和推崇。

AI课程导读

本课程围绕 MATLAB 强化学习设计器,带你走通深度强化学习“环境搭建—智能体创建—参数配置—训练—仿真—结果分析”的完整流程。课程不空谈理论,而是把算法、程序、论文毕设和实际应用紧密结合:配套程序与课件免费下载,程序有详解,可直接替换自己的数据,并指导调参、答疑与结果复用。你将学习创建和导入 MATLAB/Simulink 环境,配置 DQN、PPO、DDPG、TD3 等智能体,理解 Q 网络、双 Q 学习、经验回放、目标网络、优化器、ε-贪婪探索与 OU 噪声,掌握训练停止准则、曲线判断、仿真测试、图像与数据保存,以及继续训练和预训练智能体导出。适合强化学习初学者、需要做算法论文或毕设的学生,以及希望用 MATLAB 快速验证想法、提升科研与工程效率的人。学完后,你能独立完成强化学习项目的主要实验环节,并把方法迁移到自己的课题与数据中。

AI课程大纲

正一算法程序视频

zhengyi

郑一,青岛高校退休多年,三级数学专业教授,硕士研究生导师。在职期间主讲本科生课程、研究生课程多门,主编《概率论与数理统计》等教材及学习指导书7部。讲授强化学习和深度强化学习、卷积神经网络和长短时记忆网络、信号分析与处理算法、图像分析与处理算法、遗传算法、粒子群优化算法以及两个算法融合等30多门算法视频课程,算法课程远销台湾、香港、英国、德国和美国等地区或国家,深受网友们和学子们的喜爱和推崇。

评价

给该课程打分:

发表