如何把 AI 协作从聊天框里救出来
社区讨论 · 赛道

如何把 AI 协作从聊天框里救出来

冯sir冯sir9月2日2026/09/02 33 浏览

上周带组里两个学生做一个视觉标注小工具,需求在飞书聊天,代码日志在 Claude Code,模型输出又贴回群。从原理上讲,这不是协作工具的问题,是项目对象没被拆开。任务、决策、阻塞、证据混在一起,AI 越积极,人越不敢存档。

我拿 Windrunner 这个 Show HN 的思路做了一套 0 到 1 模板。它首页写得很短:

Work with your team and AI. Keep every project moving.

这句话的重点不在“AI”,而在 keep moving。AI 负责生成,项目负责承接。下面按这个思路做。

先把四类对象建出来

这个概念需要先理解:协作空间不是文档堆,而是四类对象。

1. 新建一个文件夹,叫 windrunner-local。

2. 在里面新建四个文本文件:work-items.md、decisions.md、blockers.md、evidence.md。

3. 每个文件第一行只写标题,例如 # Work Items,保存。

4. 打开 work-items.md,输一行:- [ ] 标注工具支持多边形导出。看到方框任务,预期它是待办,不是结论。

5. 打开 decisions.md,输:- 2026-09-02 选择先做导出,不做实时协作。理由:当前瓶颈是人工标注耗时。

6. 打开 blockers.md,输:- 依赖:需要确认图片尺寸上限。

7. 打开 evidence.md,输:- 公告原文第 3 段:项目目标为……。这周我读公告原文,发现很多争论不是观点错,是原文没编号。

如果你能打开 Windrunner 网页版,就找 work items、decisions、blockers、evidence 这几个入口,把同样内容填进去。若还没开放注册,本地模板也够跑一轮。

给 AI 设边界,再让它干活

我之前的判断没变:AI 输出要当不可信数据。教程里最容易出错的是直接问“帮我总结项目”。结果它把猜测写成事实。正确做法是固定提示词模板。

在聊天机器人或 Claude 里输入:

你只能根据我粘贴的材料输出。
材料没有写的内容,标记为“未知”。
不要安慰我,不要补全动机。
输出三段:事实、推断、需要验证的问题。

然后把 evidence.md 里的一条原文贴进去。看到三段结果,预期是它把未知单列出来。如果它没有输出“未知”,说明约束不够,需要把“禁止补全”放更前。

先写验收标准。比如任务“支持多边形导出”,验收标准是:导出 JSON 包含 points、label、image_id;缺任一字段,任务不能从 work items 移到 done。这个规则写进 work-items.md,AI 就不会自己宣布完成。

跑通一次,再考虑多人

我这边试下来,第一次闭环很短:建文件、贴原文、让 AI 分事实/推断、把推断变任务。跑完大约十几分钟。效果不是少写代码,而是少开会。以前一个导出格式要群里聊半天,现在先去看 decisions.md 有没有理由,再看 evidence.md 有没有原文。

常见坑有三个。把聊天截图当证据。截图只能证明说过,不能证明需求成立。把 AI 总结写进 decisions。总结要先进 evidence,再被人工确认。只有一个任务文件。没有 blockers,AI 会不断生成新想法,项目反而停不下来。

下一步可以试的是:把这套模板接到团队群里。每次 AI 回复后,要求它追加一行 来源:work-item-xx 或 来源:unknown。这样项目能继续跑,也不会把模型幻觉带进存档。

但还有一个问题没解决:如果多人同时改 decisions,谁来判断哪条证据优先级更高。这个可能比 AI 会不会写代码更麻烦。


📌 本文编译自 Hacker News,原文:https://shzlw.github.io/windrunner/

版权归原作者所有,本文为基于公开报道的编译与独立分析。

2 条回复

?
Ctrl + Enter 快速回复
壁垒哥
壁垒哥9月2日

刚把代码审计Agent接进流水线,发现最大的坑不是AI生成慢,而是合并前的信任层。没做可回放机制,绿灯亮得我心里发虚...

论文何
论文何9月2日

等等,你这“四类对象”听着挺玄乎。我上周用 WorkBuddy 理文献时才发现,真正卡人的不是没分类,而是 AI 吐出来的东西太碎,人还得手动拼上下文……