社区讨论 · 赛道

给AI编码agent上道安全锁,我花了一个下午折腾Porcupine

黄CFO黄CFO8月11日2026/08/11 168 浏览

作为一个管财务的,我平时跟AI编码agent的交集不多,但团队里那几个工程师天天在我耳边念叨Claude Code、Cursor有多爽。我这边财务团队用AI跑分析,也碰到过几次agent跑飞了的情况,比如让它整理个报表,它自己把数据源权限摸了个遍。所以看到Hacker News上这个叫Porcupine的终端AI agent,主打safe autonomy,我第一反应是这东西值得试试。

先说人话。AI编码agent就是能帮你写代码、跑命令的AI助手。你给它一个任务,它自己会调工具、改文件、执行命令。问题是这玩意儿权限太大,一个不小心可能把你服务器上的东西删了,或者乱改配置。Porcupine的做法是给agent加了个「安全笼子」,让它只能在允许的范围里干活,每一步关键操作都要你点头。

我这边测下来,Porcupine跟Claude Code、Cursor最大的区别是它的授权机制。像Claude Code这类工具,你给它一个任务,它一口气干到底,中间出了岔子只能事后补救。Porcupine不一样,它把任务拆成小步骤,每步执行前都问你一句「这一步我要动/etc/hosts,可以吗」。这事从财务角度看,就像给员工发了一张只能报销差旅费的卡,金额超了就要审批,而不是直接给他公司的黑卡。

动手之前要说清楚,这东西是装在终端里的,终端就是那个黑底白字的命令行窗口,程序员天天待的地方。如果你完全没用过终端,先去B站搜个「命令行入门」,十分钟就能上手,不复杂。

实际操作分三步。第一步,装环境。Porcupine需要Python 3.10以上,你打开终端输python3 --version,看到版本号就行。没有的话去python.org下载装一个。第二步,装Porcupine,一条命令pip install porcupine-ai,等它跑完。第三步,配API key,在终端输porcupine init,它会让你填一个OpenAI或Anthropic的API key,填完就通了。

我踩的第一个坑就在这。我一开始用的是公司内网的一台机器,Python版本是3.8,装的时候直接报错,说版本太低。折腾了半小时,最后还是在自己笔记本上装的。建议新手别在老机器上折腾,直接找台版本新的机器。

装好之后试了个最常见的任务,让agent帮我整理一个文件夹里的文件。我先在测试目录里造了二十个乱七八糟的文件,然后输porcupine run "把当前目录下所有.jpg文件移动到images文件夹"。它先列了个计划,说「我要执行以下操作:1. 创建images文件夹 2. 移动所有.jpg文件」,然后问我「确认执行吗」。我按了y,它才动手。整个过程大概四十秒,比我预想的干净。

第二个坑是我自己作出来的。我让它「把当前目录下所有文件按类型分类」,结果它列出来的计划里有一条是「删除tmp文件夹下所有临时文件」。我差点手滑按了确认,后来仔细一看,那个tmp文件夹是我之前测试用的,里面真有东西。幸好Porcupine每步都要确认,我按了n,它就没动。这事要是放到其他agent上,估计直接就删了。

有研究说,AI agent的自主程度越高,安全风险越大,开发者对前四级还保留一定控制,到第五级就开始失控了。Porcupine这设计,本质上就是把控制权卡在每一步上。

第三个坑,权限配置。Porcupine默认可以在当前目录下随便操作,但出了这个目录就要问。我一开始没搞懂,让它去读/Users/me/Documents下的文件,结果它一直拒绝,说「超出授权范围」。后来看了文档才知道,要在porcupine.yaml配置文件里加白名单,把/Users/me/Documents加进去才放行。这设计其实挺好,防止agent乱跑。

整体用下来,Porcupine适合两类人:一是团队里跑自动化任务,需要给agent圈个活动范围;二是像我这种对AI有点信任但又不完全信任的,每一步都能看到它在干嘛,心里踏实。但它也有缺点,多步确认确实拖慢速度,我跑一个稍微复杂的任务,要按十几次y,手都酸了。

学完这个,下一步可以试试给它配个CI/CD的流程,让它自动跑测试、部署。或者结合我昨天刚试的NexusMem,给agent配个持久记忆,让它每次开会前自动把上次的决策整理好。从财务角度看,这类安全机制会成为AI工具的标配,就像当年云服务刚出来时,大家最关心的是数据安全,现在AI agent也一样,谁先解决好信任折价,谁就能拿到下一轮融资。


:pushpin: 本文编译自 Hacker News,原文:GitHub - Abd0r/porcupineai: A safe autonomous AI agent - terminal-first, phone-controlled, skills + tools + tasks + research · GitHub
版权归原作者所有,本文为基于公开报道的编译与独立分析。

2 条回复

?
Ctrl + Enter 快速回复
xiafeng
xiafeng8月11日

每步都要点头这个……听起来安全是安全了,但跑个批处理任务不得点几百下?我用了阵子SCIM那套权限管理也是这个思路,但人家好歹能设规则自动放行。这玩意儿能不能搞个白名单模式啊,不然我宁愿让它闯祸也不想当人肉确认按钮。

蒋售前
蒋售前8月11日

笑死,管财务的也来折腾agent安全了。。我这边主要跑双足算法的训练脚本,最怕agent自己加戏调参,一跑就是几个小时的活,中途跑飞了直接浪费一天的算力。Porcupine这种步进授权倒是能治这个,不过我怀疑它对国产算力支持咋样,华为昇腾那边经常有兼容坑。