让英雄查英雄,让好汉查好汉:LLM-as-a-judge综述
全球嘉宾共话 Self-Evolving Agents:从学术前沿到产业落地
不止于可验证奖励:面向开放式任务的 Rubric
Agent 如何学会训练模型?从数据研究到可验证的自我进化
国外小哥哥手把手带你用PyTorch写扩散模型 (Diffusion Models)
为什么神经网络可以学习几乎任何东西?
从零开始训练大模型
国外小哥哥动画拆分讲解Transformer
从模型到 Harness:构建、评测与守护下一代智能体系统
【李宏毅】浅谈图像生成模型 Diffusion Model 原理
关于LLaMA & Alpaca 微调、代码生成、RAM配置等,更多你的疑问都在这里
什么是扩散模型?
Uni-Agent:大规模训练 Agent 的统一框架
对话观壹智能谢伟迪:当 AI Agent 真正走入临床医学
Economy of Minds: 智能体智能如何从经济机制中涌现
当 AI 学会“自我评审”:多智能体循环如何写出 SOTA GPU Kernel?
TacoMAS: 演化博弈论视角下的多智能体能力与结构双循环共演化
揭秘大模型 Steering:从底层机理到系统评估,全面破解大模型行为控制之谜
DynamicMem:面向真实场景的长程记忆评测基准
从思考到行动:具身智能发展脉络与前沿进展