今天对比了一下智谱清言、豆包的agent能力
斑马街
2026年06月26日 20:31

用codex(gpt5.5)、智谱清言里的agent模式(glm5.2)和豆包电脑版中的办公模式(seed 2.1 turbo)测试完成同一个任务:登录并爬取某个网页中一千多道题目然后保存成一个pdf。

gpt和glm都顺利完成了,glm耗时稍久一点,但是也很完美,甚至pdf还有一点排版。豆包失败了,我不知道是不是没有用seed 2.1 pro模型的原因,但是我发现豆包在干这个任务时候还是倾向于用网页截图来思考,相反codex和智谱都是直接走cli的方式来拉网页响应,这个思路明显更快。

但是豆包在完成另一个测试:下载播客音频,转为文字稿并整理核对文字稿错误,生成笔记,最后根据笔记输出一份ppt的任务中表现很好,特别是中间对于飞书的调用,这点优势太大了。