
数据圈都在聊大模型的时候,我让 WorkBuddy 把上个月的脏活全接了
今天刷到 KDnuggets 推送,五篇里有四篇在讲 AI coding agent、本地跑模型、生产环境部署。写得挺好,就是离我这种每天跟报表、发票、微信群文件打交道的人有点远。动不动就是 llama.cpp 三层调用,我看完只想问一句:谁来帮我把上个月那 200 份合同归档了?
说这个是因为上周五,我客户那边推过来一个压缩包,里面是上季度的对账单、验收单、付款凭证,PDF 和 Excel 混着,文件名还全是「新建文档(7)」这种。换以前我得一页页打开看内容才能分类,再做一张汇总表。这回我直接扔给 WorkBuddy 了。
先说我怎么配的。打开 WorkBuddy 的 任务流,选「自动归档」模板。它会先弹出一个文件夹选择器,我指定了一个本地目录作为收件区,叫「待处理」。任何文件丢进去,任务流就自动开始。然后我加了三个动作:第一步识别文件类型,第二步按规则重命名,第三步把文件归到对应的子目录。识别那块我选了「智能分类」,它会先用内置的文档理解能力扫一遍内容,再打标签。试跑了几份后,我发现它会把增值税发票和普通收据分到同一类,因为两者都有「发票」字样。我在规则配置里加了个关键词条件,发票 且 含税额 才归类到「财务-发票」,其他带发票字样的归到「财务-其他」。这就绕过了第一个坑。
接下来是汇总。WorkBuddy 自带一个数据表插件,我建了一张统计表,字段设了日期、供应商、金额、凭证类型。任务流里多加一步「提取数据写入统计表」,只要归完档的文件里有数字表格,它会自动抓表头对应的列填进去。这一步最省时间。以前我手工做这个要一个下午,现在大概十分钟跑完,准确率在九成左右,剩下的抽查一遍就行。
不过权限那块我踩了个坑。任务流刚建好时用的默认配置,运行角色是我的账号,结果团队成员打开归档文件只能看不能跑。后来我进 任务配置 → 运行权限 里把执行角色改成了「管理员组」,保存路径的读写权限在系统设置里给财务口的人单独开了可编辑,其他部门只读。现在分工是:财务负责审核识别错的条目,我只看统计表的异常值,业务那边只能查最终归档。这样各管一截,没人能顺手改坏原始数据。
日常运维其实不复杂。我每周一早上花两分钟看 任务流日志,重点关心有没有识别失败的文件被扔进「未识别」目录。目前跑了三周,失败率不高,主要来自扫描件太模糊。我的应对是在入口目录放了一个质检任务,每天下午五点自动扫描「待处理」里超过 24 小时未归档的文件,推一条提醒到微信,免得我手动翻目录。
说个真实感受。KDnuggets 那篇文章讲五层工具栈搭 agent 的时候,我脑子里想的其实是,真正在生产环境跑的流程,未必是模型多大多快,而是稳。WorkBuddy 这个东西不炫,但把数据入口、流转路径和权限边界都收住了。以后这种 AI 流程编排的能力大概率会下沉到数据分析的基础操作里,像我们这种不看论文的干活人,最先受益的反而是这种把「用 AI 拆文件」变成「点两下就行」的小闭环。往后我打算把月报里图表生成那段也塞进来,试试能不能让 PPT 自己长出来。
物界前沿