
给自己做一次可替代性体检
周末折腾了一下 Am I replaceable,踩了不少坑。它是个 AI 吐槽工具,问的是你有多容易被 AI 替掉。这里的 AI 只根据你给的文字做判断,不查你公司的系统。它更像一面镜子,把工作内容丢进去,让它用 Nice、Honest、Brutal 三档说话。
从组织层面看,我不建议拿它给同事打分。团队成长很重要。它更适合提醒我们,哪些工作已经流程化,哪些判断还离不开人。下面按入门路线走一遍,从输入到改进,大概分三天。
第一天,先别打开网页。拿一张纸,写下本周实际做的五件事。别写负责项目管理,要写把客户反馈分成账单、登录、功能建议三类,再给开发排优先级。新手最容易输岗位名,模型会回一段空话。
再打开 Am I replaceable 入口。界面很简单,通常有一个输入框,一个模式选择,一个 生成 按钮。三档里,Nice 温和,Honest 直说,Brutal 毒舌。第一次选 Honest,别选 Brutal,容易把工具体验变成情绪体验。
输入框里可以照抄这个模板:我的实际任务是把客户反馈按账单、登录、功能建议分类,并给出修复优先级;我每周固定花几小时,需要判断哪些客户会流失;请从可替代性角度评价,给一个分数和三条理由。
点生成后等一会儿。正常结果会先给一句判断,再列理由。比如它可能说分类可以模板化,但判断客户流失需要上下文。如果只看到分数,没有理由,说明任务描述太短。看到这个结果,先复制原始输入和输出。踩坑点在这里,很多人只存结论,不存输入,一周后想复盘,已经不知道自己写了什么。
第三天,把结果变成改进表。建一个三列文档,列名分别是任务、AI 能做哪一步、人必须守住的边界。把五件事填进去。你会发现有些可以交给脚本,有些要跟客户确认,有些要负责人点头。这里可以用 harness 这个词,大白话就是给 AI 搭一个能跑、能看、能停的评测台。它的作用是帮你判断 AI 该插在流程哪一段。
项目 README 里提到 Nice、Honest、Brutal 三档,本质上是在调节批评力度,不改变事实。关键看你愿意看哪一种。
一周后,可以拉小团队试一次。先把姓名和敏感客户信息去掉。我拿一个跨时区团队做过简化版,每人只贴任务,不贴绩效,最后一起找重复劳动。这次试下来,大家发现固定时间的会议纪要确实可以被摘要工具吃掉。
最后留几条避坑提醒。岗位头衔不适合当输入。Brutal 结果别在公开群里晒,容易伤团队。AI 的一句评价不能当裁员依据,它没有业务数据,也不懂老板的真实偏好。如果结果太笼统,补上时间、频次、判断标准。记得保存版本,方便一周后对比。
学完这个,下一步可以试把任务表接到 WorkBuddy 或 README 里,变成每周固定的可替代性体检。从组织层面看,我更倾向把它当成流程审计工具,别拿它审判人。接下来半年,团队周会里大概率会多一项,内容是这周哪些工作已经像流水线,哪些还只能靠人现场判断。
📌 本文编译自 Hacker News,原文:https://amireplaceable.app/
版权归原作者所有,本文为基于公开报道的编译与独立分析。
物界前沿