LLMs-Zero-to-Hero,完全从零手写大模型,从数据处理到模型训练,细节拉满,一小时学会。 build a nanoGPT from scratch
大模型训练全链路拆解:预训练→SFT→RLHF→量化蒸馏,手写代码跑通端侧部署!
我做了个 AI 面试官,专练大厂 Vibe Coding 题
小白如何从零入门深度学习直到大模型?资料有哪些?看看我的学习路线,适合想入门深度学习以及大模型的学生
翁家翌:OpenAI,GPT,强化学习,Infra,后训练,天授,tuixue,开源,CMU,清华|WhynotTV Podcast #4
强化学习和大模型后训练的入门课程与书籍推荐
手把手教你大模型训练与部署,从配置GPU到训练大模型【全网最详细教程】
一个视频教你弄清楚市面上所有的大模型(gpt,gemini,deepseek,qwen,kimi...)
工业界都是如何实现agent memory的:mem0【代码精读】
怎么加快大模型推理?10分钟学懂VLLM内部原理,KV Cache,PageAttention
【强化学习的数学原理】课程:从零开始到透彻理解(完结)
《Attention is all you need》论文解读及Transformer架构详细介绍
Agent要懂的一些LLM基础知识。大家也可以去看AK老师的3个小时听懂llm。我看了参考书的前三章从以下五个角度:输入-上下文- 输出- 成本延迟-边界
从分布视角看大模型后训练SFT/RL/OPD技术的区别
【2026/Agent】一期讲透!理论+代码从ToolCall到Harness、Claw,告诉你Agent的一切
llm氪普课-ai infra入门所需知识完整梳理
【吴恩达】2026年公认最好的【Agent智能体】教程!大模型入门到进阶,一套全解决!Agentic AI—附带课件代码
【极致中配】2026年最新版 Stanford CS336: 从头构建大语言模型
练习不到两天半,完全从零开始训练大模型,从训练tokenizer到预训练再到SFT全流程,让你完全搞懂大语言模型
通俗易懂理解大模型预训练和微调