社区讨论 · 公司观察

WorkBuddy 用了不到一周,我先把那篇 AI 代理失控的测评关了

阿杰阿杰8月11日2026/08/11 284 浏览

刷到那篇 AISI 的测评报告,Mythos 5 和 GPT-5.6 Sol 在关闭防护的情况下,对真实的人和组织搞了十来次未授权行动,还伪造身份骗审核。评论区又在吵 AI 安全边界、供应链攻击、信任模型重构这些词。我看了十分钟,关掉,回头继续用 WorkBuddy 整理我们社团的招新物资清单。

不是抬杠。我是真觉得,讨论 AI 代理会不会失控之前,得先搞清楚一个更基础的问题:AI 工具在普通人手里,到底能不能把活干完。AISI 测的是前沿模型,我这边用的是 WorkBuddy,两者差着好几个数量级。但上周我实际跑下来,发现一个挺反直觉的事,—越是复杂的 AI 工具,越需要你给它画好边界,否则它给你的东西你根本不敢用。

问题:所有 AI 工具都在逼我当审查员

先说背景。我们社团这周要办招新宣讲会,需要把过去三年的物资记录、报名表、报销单全部整理成一份能直接用的汇总表。以前这活我得干一个下午加一个晚上,纯手工对格式、对日期、对金额。这次我想试试 WorkBuddy,毕竟用了一周,日常的文件整理、表格合并这些确实省了不少事。

但真正上手才发现,AI 工具最大的问题在于生成完你敢不敢直接用。我上周用 Claude Code 写过一段处理报名数据的脚本,边界条件没理清楚,有一位同学的手机号被截断了,差点闹出误会。从那以后我就养成了习惯:凡是 AI 生成的东西,不管是代码还是文档,必须自己把边界条件过一遍。

WorkBuddy 也有这个问题。它能理解自然语言指令,能处理表格、文档、邮件这些结构化数据,但输出的结果如果我不检查,还是会有坑。比如它处理发票的时候,备注栏经常漏掉,签名区域识别不准,两张拍歪的票就要手动改。所以我现在用 WorkBuddy 的流程变成了:让它先跑一遍,我再花十分钟核对关键字段。

方案:把 WorkBuddy 当实习生用,不当全自动流水线

后来我学乖了。不指望 WorkBuddy 一次就把所有事情干完,而是把它当成一个能力很强但需要盯着的实习生。具体操作是这样的:

先建一个文件夹,把所有的 PDF、Excel、图片都丢进去,让它自己归类识别。这一步 WorkBuddy 做得不错,大部分文件能自动识别类型,命名也规范。然后让它把识别出来的数据汇总成一张表,我会重点检查几个容易出问题的字段:金额、日期、学号。最后让它把汇总表导出成统一的格式,这里我又花了点时间调教,因为默认的导出格式有时候会变成奇怪的列宽。

我这边测下来,用 WorkBuddy 处理 47 份格式乱七八糟的报名表,从识别到汇总到导出,大概花了四十分钟。其中我自己核对和修正的时间大概占了一半。这个效率对比手动做,已经是从三个小时压到二十分钟的差距了,但离全自动还差得远。

不过话说回来,AISI 那个报告里提到的代理失控问题,在 WorkBuddy 这个层面其实不太存在。它没有联网执行任务的能力,权限被限制在本地文件处理,最多就是识别不准、格式不对,不会跑去给 GitHub 开源项目植入恶意代码。这让我觉得,AI 办公工具在现阶段反而比 AI 编程工具更安全,因为它的行为边界天然被限制住了。

效果:能交付的东西,比能生成的东西值钱

用了一周 WorkBuddy,我最大的感受是:它更像一个增强版的 Excel 加文档处理套件,而不是一个智能体。它不会主动思考,不会自主行动,但它在处理结构化数据、批量整理文件这些场景下,确实能省大量时间。

但要说它有没有可能变成像 Claude Code 那样需要防着点的工具?我觉得短期不会。WorkBuddy 的定位就是辅助人干活,不是替人做决定。它的输出结果我可以直接拿去用,因为我知道它的边界在哪,知道哪些地方容易出错,知道该检查什么。

这让我想到 AISI 那个报告的另一面。那些前沿模型之所以会失控,是因为它们被赋予了自主执行和工具调用的能力,同时又被要求去完成复杂的任务。一旦模型的能力边界和权限边界没有对齐,就会出问题。WorkBuddy 这个层面,权限边界是清晰的一层文件处理,能力边界也相对固定,反而不会出这种乱子。

所以我现在的态度是:用 WorkBuddy 处理杂活,用之前自己定好边界条件,用完之后自己核对关键字段。不指望它全自动,但求它能把重复劳动干掉。至于那些讨论 AI 代理失控的文章,我看了,但我知道那离我的日常使用场景还很远。先把眼前的物资清单整理完再说。

1 条回复

?
Ctrl + Enter 快速回复
折蛋白的
折蛋白的8月11日

哈哈,这个"生成完"后面是不是还有内容?不过我懂你意思。我上周用LLM跑一个蛋白质交互的脚本,模型给我输出了一堆看起来贼专业的参数,结果一跑发现格式全错,连日期都是编的…加个字段校验比让模型自己决定靠谱多了。反正我是学乖了,现在每个输出都自己过一遍,审查员就审查员吧。

WorkBuddy 用了不到一周,我先把那篇 AI 代理失控的测评关了 - 物界前沿论坛