姚顺雨-从语言模型到语言智能体(From Language Models to Language Agents)
【吴恩达】2026年公认最好的【Agent智能体】教程!大模型入门到进阶,一套全解决!Agentic AI—附带课件代码
Agentic RL 如何让语言模型成为自主Agent
(中英双语!)吴恩达最新《Agentic AI》大佬亲授智能体教程,附示例代码!_deeplearning.ai
【强化学习的数学原理】课程:从零开始到透彻理解(完结)
[EP-5] 字节Verl: 最常用的RL强化学习训练框架
【伯克利大学】《Agentic AI》(全13讲)在实际场景中,像工程师一样打造AI智能体!
企业智能Agent落地实战!RL+Function Calling双引擎,让模型主动思考、精准调用、智能执行!
【青稞Talk101期】MiniMax M2.1:Agent 后训练经验与认知
[Agentic RL][06] 练习两天半,使用verl实现code-r1(agent-rl,verl二次开发),原理到代码实现全流程解读
2026版LangChain教程,langchain快速入门, Agent智能体rag项目实战
(B站首推)2026李宏毅智能体【Harness Engineering】系列课程全集,公认体验感最好的入门课程!--人工智能/大模型/Agent/LLM
【2026最新版】LangChain✚LangGraph✚MCP✚Agent智能体企业级开发实战,零基础入门到项目实战开发教程!码士集团(附:学习笔记)
[EP-6] ARPO: 初探Agent-RL算法
加州大学洛杉矶分校【中英⚡LLM与强化学习|Spring 2025, Reinforcement Learning of Large Language Mod】
(B站首推)2026李宏毅智能体【AI Agent】系列课程全集,公认体验感最好的入门课程!--人工智能/机器学习/深度学习/大模型/LLM
[Agentic RL][05] 练习两天半,教你如何使用verl框架进行强化学习(环境安装、数据集处理、奖励函数构建、重要参数解析、debug)
黑马程序员大模型RAG与Agent智能体项目实战教程,基于主流的LangChain技术从大模型提示词到实战项目
【青稞Talk 68期】slime:专为 RL Scaling 设计的大规模 RL 训练框架及实践
一个高效可扩展的 Agentic RL 框架