【吴恩达】2026年公认最好的【Agent智能体】教程!大模型入门到进阶,一套全解决!Agentic AI—附带课件代码
《Attention is all you need》论文解读及Transformer架构详细介绍
【带读AI经典论文|100篇】世界顶级大佬带你逐句阅读最重要的100篇AI论文
[LLM+RL] 理解 GRPO 公式原理及 TRL GrpoTrainer 代码实现(advantage 与 loss 计算)
零基础学习强化学习算法:ppo
LLM大模型入门!一口气带你学完AI agent、transformer、LangChain 、RAG 等大模型核心知识点!简直不要太爽!
【精读AI论文】知识蒸馏
卷积究竟卷了啥?——17分钟了解什么是卷积
Flash Attention 为什么那么快?原理讲解
【12】LoRA、QLoRA 讲解
[知识蒸馏][01] 耗时两天半,完全从零开始实现大模型知识蒸馏(Qwen2.5系列模型),从原理讲解、代码实现到效果测试,绝对让你搞懂模型蒸馏
20分钟读懂AI神级论文《Attention Is All You Need》
Transformer论文逐段精读【论文精读】
光的衍射就是卷积
LLMs-Zero-to-Hero,完全从零手写大模型,从数据处理到模型训练,细节拉满,一小时学会。 build a nanoGPT from scratch
【大白话03】一文理清强化学习RL基本原理 | 原理图解+公式推导
【浙江大学-大模型原理与技术】1-0 序言
如何训练一个写小说的大模型?
【7】Flash Attention 原理讲解
Sora、Stable Diffusion、可灵文生图视频大模型原理讲解