
ChatGPT狂飙
共3节 已有3人学过
主讲老师ZOMI
更新时间2025-12-26 15:44:55
课件资料暂无
免费
加载中...
课程介绍
讲师介绍

ZOMI
暂无讲师简介
AI课程导读
这门课用三讲串联ChatGPT从“语言模型”走向“对话智能”的关键路径:第1讲梳理GPT-1到GPT-3的技术演进,对比GPT与BERT,讲清zero/few-shot、prompt learning与instruction learning;第2讲进入强化学习与RLHF,理解Agent、奖励、策略、Policy Gradient和PPO;第3讲剖析InstructGPT/ChatGPT的SFT、Reward Model、PPO三阶段训练,以及人类偏好如何转化为奖励信号、KL约束如何稳住策略。课程核心价值在于不堆术语,而是把ChatGPT背后的模型演进、对齐训练和强化学习主线讲通。适合AI爱好者、算法工程师、产品与技术管理者,以及想系统理解大模型原理的人。学完后,你能说明GPT与BERT差异,解释RLHF为何重要,掌握PPO在InstructGPT中的作用,并建立从GPT-3到ChatGPT的完整认知框架。
AI课程大纲
ZOMI
老师简介
评价
给该课程打分:
发表
