江鋆晨: 大模型记忆,KV Cache,清华姚班,CMU,教授,开源,视频流媒体
【青稞Talk 78期】从 LLM-RL 到 Agentic RL:如何让语言模型成为自主智能体|青稞Talk 78期
对话盛颖:xAI,Infra的浪漫,SGLang,开源,平权与“甄嬛传”【101视频播客】
Rectified Flow:矫正流生成式模型的概念及应用实践|青稞Talk 31期
【伯克利大学】《Agentic AI》(全13讲)在实际场景中,像工程师一样打造AI智能体!
【2026/Agent】一期讲透!理论+代码从ToolCall到Harness、Claw,告诉你Agent的一切
Agent、Skill、Harness啥意思?一次性讲明白AI技术名词!
verl: An Open-Source Large-Scale LLM RL Framework for Agentic Tasks
【青稞Talk101期】MiniMax M2.1:Agent 后训练经验与认知
Matt Pocock 直播实战:从零搭建一个全新项目——2小时从想法到完整架构设计
2026版LangChain教程,langchain快速入门, Agent智能体rag项目实战
【青稞Talk 135期】如何设计一个好的自回归 VLA:从问题构建到工程落地的探索之旅
【青稞Talk 141期】Alignment unlocks Scaling:Qwen-Robot Suite 的设计原理和背后的思考
【青稞Talk95期】从 π_0 到 π_RL:面向流匹配 VLA 的强化学习后训练框架
MiniMax冯雯这套AI用法,挺狠。
[校招最新最吊项目]全栈从0-1手写AI Agent平台:Agent,RAG,MCP网关,计费,高可用项目
【2026最新版】LangChain✚LangGraph✚MCP✚Agent智能体企业级开发实战,零基础入门到项目实战开发教程!码士集团(附:学习笔记)
S-LoRA:实现多 LoRA 大模型的高效并行化推理|青稞Talk 20期
【青稞Talk102期】从 TRPO 到 SAPO:大模型 RL 算法演进
【青稞Talk 136期】PithTrain:Agent 时代的 MoE 训练框架设计