让英雄查英雄,让好汉查好汉:LLM-as-a-judge综述
国外小哥哥手把手带你用PyTorch写扩散模型 (Diffusion Models)
提示学习工程概述—Prompt Engineering Overview
什么是扩散模型?
全球嘉宾共话 Self-Evolving Agents:从学术前沿到产业落地
为什么神经网络可以学习几乎任何东西?
不止于可验证奖励:面向开放式任务的 Rubric
Agent 如何学会训练模型?从数据研究到可验证的自我进化
【李宏毅】浅谈图像生成模型 Diffusion Model 原理
从模型到 Harness:构建、评测与守护下一代智能体系统
关于LLaMA & Alpaca 微调、代码生成、RAM配置等,更多你的疑问都在这里
对话赵晨阳:SGLang、AI Coding、核心代码库、休学入行、Omini困局、评测、代码膨胀、中美差距、入行建议等
TacoMAS: 演化博弈论视角下的多智能体能力与结构双循环共演化
Uni-Agent:大规模训练 Agent 的统一框架
Economy of Minds: 智能体智能如何从经济机制中涌现
LLM推理还能更快吗?投机解码的下一站:在线演进、扩散草稿与并行解码树
从思考到行动:具身智能发展脉络与前沿进展
DynamicMem:面向真实场景的长程记忆评测基准
当 AI 学会“自我评审”:多智能体循环如何写出 SOTA GPU Kernel?
为大模型写一部原生语法:从表征几何到模型电路