【吴恩达】2026年公认最好的【大模型微调】教程!大模型入门到进阶,一套全解决!Fine tune the LLM large model-附带课件代码

3.3万
106
2025-12-16 11:44:26
512
231
2129
152
【DeepLearning.AI新推短课:LLM微调大模型】 授课老师:Sharon Zhou教授 和吴恩达(DeepLearning.AI)教授 视频来源:DeepLearning.AI 课件代码:评论区自取 本课程我们将学习到: 1 理解LLM后训练的核心概念 2 掌握指令微调 3 学习人类反馈强化学习(RLHF)基础 4 实践高效的微调方法 5 了解后训练的挑战与评估
可咨询/1V1技术指导 AI大模型应用开发、Agent智能体开发、AI产品经理、具身机器人二次开发(在职赋能、转行就业)
视频选集
(1/17)
1.大语言模型微调之道1——介绍
03:00
2.大语言模型微调之道2——为什么要微调
14:36
3.大语言模型微调之道3——微调在训练过程中的位置
15:11
4.大语言模型微调之道4——指令微调
09:01
5.大语言模型微调之道5——准备数据
10:54
6.大语言模型微调之道6——训练过程
16:16
7.大语言模型微调之道7——评估和迭代
11:30
8.大语言模型微调之道8——建议和实用技巧
04:30
9.大语言模型微调之道9——总结
00:19
W1_L1 莎朗·周和吴恩达的对话
10:45
W1_L2 背景
05:13
W1_L3 后期训练(微调和RL)适合LLM训练的地方
06:31
W1_L4 微调和RL背后的直觉
04:50
W1_L5 使微调和RL发挥作用的关键组件
10:34
W1_L6 后期训练示例:推理
05:20
W1_L7 后期训练示例:安全和安保(RLAIF)
04:40
W1_L8 野外后期训练
04:17
客服
顶部
赛事库 课堂 2021拜年纪