排行榜上的大模型再厉害,我的报销单还是 WorkBuddy 收拾的
刷到那篇中外大模型对比评测,Gemini、GPT、Claude 一个个吹得天花乱坠,GitHub 星标高到吓人。我大概扫了一眼就关了。这些模型确实强,可榜单上的东西离我太远了。我每天要对付的,是几十张发票、乱七八糟的截图、还有月底那份永远理不清的报销汇总表。
我上周写过一篇帖子,说 WorkBuddy 批量整理报销单总是漏数据。当时挺郁闷的,十几张 PDF 和图片拖进去,金额识别得还行,日期却乱套了。后来我仔细排查了一下,问题多半出在我自己身上。那会儿我刚上手,什么任务都一股脑开 Craft 模式,觉得模式越高级越稳妥。结果就是,一次丢进去太多文件,上下文堆得太长,它反而处理不过来。工具没问题,是我用法不对。
这两天我重新跑了一遍完整流程,把每一步都记下来了,给同样被报销单折磨的人一个参考。WorkBuddy 处理这类活是够用的,但前提是别把它当成许愿池。
我现在的做法是这样的。打开 WorkBuddy 之后,先建一个专门的工作区,别跟其他杂事混在一起。然后在工作区里新建一个任务,类型选「表格整理」而不是默认的「智能问答」。这一步很关键,因为选错模式,它处理表格的方式完全不一样。上传文件的时候,我建议分批来,一次最多五张,不要贪多。我之前一次性拖了十几张进去,它直接给我列出一堆乱码。分批上传还有一个好处,就是每批的识别结果可以单独检查,哪里错了能立刻定位。
传完之后,在输入框里把要求写具体。不要写「帮我整理这些发票」,要写「把每张发票的发票号、开票日期、金额、备注提取出来,填入表格,日期格式统一为 YYYY-MM-DD」。我第一次就是吃了指令模糊的亏,它把发票上的地址、电话、开户行全识别进去了,表格乱得没法看。指令越具体,它越不容易自由发挥。
提交之后,它会先生成一个预览表格,这时候别急着点确认。我习惯先扫一眼备注列,这是最容易漏的地方。上回我报一沓打车发票,它金额和日期全对,就是备注里的出发地和目的地一个都没识别出来。后来我单独把这几张发票重新传了一遍,指令改成「只提取备注栏的起止地点」,才补齐了。这一步麻烦是麻烦点,但总比月底被财务打回来强。
对了,还有一个小设置,可能很多人没注意到。任务开始前,把上下文长度设置成短档,而不是默认的长档。这个选项藏在一级菜单的第三个 tab 里,进去之后往下拉一点就能看到。我的环境是公司配的普通笔记本,配置一般,用短档处理五张以内的文件,速度和准确率是最平衡的。如果你那边文件特别多,可以试试中档,但千万不要开长档,报表类任务开长档纯属浪费积分,我之前就是烧积分烧怕了。
我这边测下来,最稳妥的流程是:建工作区 → 选表格整理模式 → 分批发文件 → 写具体指令 → 检查预览表 → 手动补漏 → 导出。这一套走下来,三十多张发票大概四十分钟能搞定,比我手动整理快了两个小时左右。
物界前沿