【8】KV Cache 原理讲解
《Attention is all you need》论文解读及Transformer架构详细介绍
【知识科普】【纯本地化搭建】【不本地也行】DeepSeek+RAGFlow构建个人知识库
2026Minimind课程学习视频
【12】LoRA、QLoRA 讲解
【13】Attention的QKV输出的到底是什么?
【吴恩达】2026年公认最好的【Agent智能体】教程!大模型入门到进阶,一套全解决!Agentic AI—附带课件代码
【AI知识分享】你一定能听懂的扩散模型Flow Matching流匹配基本原理深度解析
【吴恩达】2026年公认最好的【大模型微调】教程!大模型入门到进阶,一套全解决!Fine tune the LLM large model-附带课件代码
极简教程! 3分钟DeepSeek接入你的知识库【不用编程】
FlowMatching的直观理解
有难度但必读的一篇论文《DeepSeekMath》
光的衍射就是卷积
deepseek r1微调模型应用落地案例(医疗法律,PatientSeek),适合借鉴学习。
怎么做Agent多智能体+开源代码
清晰说明——什么是大语言模型(LLM:从零到一)【1】
【浙江大学-大模型原理与技术】1-0 序言
【B站强推】浙江大学大模型公开课,2026最新浙大内部VIP大模型课程,大模型原理与技术教程,从入门到进阶,全程干货讲解,拿走不谢!
(中英双语!)吴恩达最新《Agentic AI》大佬亲授智能体教程,附示例代码!_deeplearning.ai
深度流形漫谈(2)—— 对Goodfire流形引导的批评