从模型到 Harness:构建、评测与守护下一代智能体系统

1927
0
2026-07-16 12:20:56
40
4
129
21
内容介绍: 大模型的能力正在逼近天花板,而 Agent 真正的能力边界与安全底线,正越来越多地由模型之外的那一层 「Harness」 所决定——它定义了智能体能调用哪些工具、能访问哪些资源、信息如何在多智能体间流动,以及系统如何在错误与扰动中保持可控。从模型到 Harness,AI Agent 正进入构建、评测与治理并重的下半场。 本期 Workshop 邀请来自北美、国内与中国香港的全球嘉宾,从学术前沿、技术实践与创业探索三重视角出发,围绕三条主线展开讨论:如何构建可执行、可扩展、可治理的通用 Agent Harness(如 OpenHarness、OpenClaw-RL);如何评测智能体在完整执行轨迹中的安全与可信(从模型对齐走向 Harness 级审计);以及如何守护——通过权限边界、轨迹诊断与在线护栏,让持续运行的智能体真正值得信赖。我们希望共同回答:当能力不再只由模型决定,下一代智能系统的核心形态将如何被 Harness 重新定义。 主持人: 华文越,微软研究院高级研究员,加州大学圣塔芭芭拉分校(UCSB)计算机科学博士后,罗格斯大学新不伦瑞克分校计算机科学博士,入选 2025 年 KAUST AI 新星(AI Rising Star),研究方向为 智能体的安全性与效率、多智能体交互以及 LLM 推理。 王鸿儒,EdinburghAI & EdinburghNLP 博后,博士毕业于香港中文大学,研究对话系统、工具学习与 LLM Agents,曾在 UIUC、ByteDance Seed 访问研究。代表工作包括Cue-CoT、Self-DC、Theory of Agent等。
全球一线青年学者发起的AI分享平台,聚焦「学术-落地-创业」闭环。 合作/投稿/加入我们 请联系:zenrran@gmail.com
视频选集
(1/11)
上半场
03:04
刘承志 | 过程比结果更危险:从模型到 Harness,AI Agent 下半场该如何评测安全?
41:14
王胤杰 | OpenClaw-RL:在使用中自适应变强的龙虾
24:29
George Zhang | Eval-Driven Development: How We are gonna do it?
42:49
李子豪 | Code as Agent Harness
25:22
PANEL:刘承志、王胤杰、George Zhang、李子豪
55:07
下午场
02:40
刘东瑞 | Agent 系统的风险归因与防护
32:20
林江浩 | 从 Externalized Skills 到 Latent Skills:从潜空间视角理解、控制与组合智能体技能
30:54
汤嘉斌 | OpenHarness:面向开放智能体的通用 Agent Harness 基础设施
26:03
PANEL:刘东瑞、林江浩、汤嘉斌、马骁腾
55:26
客服
顶部
赛事库 课堂 2021拜年纪