内容介绍:
大模型的能力正在逼近天花板,而 Agent 真正的能力边界与安全底线,正越来越多地由模型之外的那一层 「Harness」 所决定——它定义了智能体能调用哪些工具、能访问哪些资源、信息如何在多智能体间流动,以及系统如何在错误与扰动中保持可控。从模型到 Harness,AI Agent 正进入构建、评测与治理并重的下半场。
本期 Workshop 邀请来自北美、国内与中国香港的全球嘉宾,从学术前沿、技术实践与创业探索三重视角出发,围绕三条主线展开讨论:如何构建可执行、可扩展、可治理的通用 Agent Harness(如 OpenHarness、OpenClaw-RL);如何评测智能体在完整执行轨迹中的安全与可信(从模型对齐走向 Harness 级审计);以及如何守护——通过权限边界、轨迹诊断与在线护栏,让持续运行的智能体真正值得信赖。我们希望共同回答:当能力不再只由模型决定,下一代智能系统的核心形态将如何被 Harness 重新定义。
主持人:
华文越,微软研究院高级研究员,加州大学圣塔芭芭拉分校(UCSB)计算机科学博士后,罗格斯大学新不伦瑞克分校计算机科学博士,入选 2025 年 KAUST AI 新星(AI Rising Star),研究方向为 智能体的安全性与效率、多智能体交互以及 LLM 推理。
王鸿儒,EdinburghAI & EdinburghNLP 博后,博士毕业于香港中文大学,研究对话系统、工具学习与 LLM Agents,曾在 UIUC、ByteDance Seed 访问研究。代表工作包括Cue-CoT、Self-DC、Theory of Agent等。