Agent Skill 从使用到原理,一次讲清
WorkBuddy 搭建个人专用Skill
【青稞Talk 68期】slime:专为 RL Scaling 设计的大规模 RL 训练框架及实践
【青稞Talk95期】从 π_0 到 π_RL:面向流匹配 VLA 的强化学习后训练框架
【青稞Talk101期】MiniMax M2.1:Agent 后训练经验与认知
【青稞Talk 136期】PithTrain:Agent 时代的 MoE 训练框架设计
【青稞Talk 133期】VeRL-Omni:基于 VeRL 及 vLLM-Omni 构建的面向多模态生成模型的高效RL后训练框架
【附PDF】突然发现李飞飞的agent综述真的好清晰!!如果你agent ai很差,一定要看李飞飞整理的这份综述!!
【青稞Talk 78期】从 LLM-RL 到 Agentic RL:如何让语言模型成为自主智能体|青稞Talk 78期
【青稞Talk 131期】UniRL:面向统一多模态模型的分布式 RL 后训练框架
OPD 专题|青稞AMA第3期
【青稞Talk106期】GDPO:解决 GRPO 在多奖励 RL 训练中的"优势崩溃"问题
Rectified Flow:矫正流生成式模型的概念及应用实践|青稞Talk 31期
World Model 专题|青稞AMA第2期
【青稞Talk 78期】从 LLM-RL 到 Agentic RL:如何让语言模型成为自主智能体
GLM 5.2 正式开源!Agent 编程能力登顶,真正百万上下文,效果实测+模型本地部署!| 零度解说
【青稞Talk 117期】OpenClaw-RL: 结合 GRPO + OPD,在使用中自适应变强的龙虾
【2026版】B站讲的最好的Harness Engineering最佳实践:深度解析AgentHarness的底层原理、核心组件和实战应用
【B站首推】Agentic RAG 才是未来!吊打传统 RAG!30分钟详解chatbox 的 Agentic 主动决策机制,手把手带你掌握下一代RAG核心原理
翻遍整个B站,这绝对是2026讲的最好的AI Agent智能体教程,手把手教你从0基础开始搭建企业级Agent智能体,全程干货无废话,让你少走99%的弯路!