社区讨论 · 政策
OpenAI第一次怕了,这算进步还是警钟
AI圈终于出了一条让我觉得后背发凉的新闻。8月7日晚上,OpenAI宣布暂缓下一代模型Astra的部分开发工作,原因很直接:内部评估显示,它在智能体编程和网络安全两个方向的能力,可能已经触到公司准备框架里的“关键级”红线。这是2023年12月那套框架发布以来,第一次有模型碰到这个档位。
这则公告的重点是OpenAI第一次主动踩了刹车。一帮自媒体急着渲染“AI已经学会自己打零日漏洞”,但官方措辞其实很克制:暂时无法排除达到临界能力,所以先停掉所有不满足强化安全要求的内部实验。
我这边更在意的是另一个细节,有圈内人直接说,Astra可能已经不需要继续开发了。细想一下,确实有点道理,一旦模型真具备了完整走完侦察、挖洞、写EXP、驻留这一整套流程的能力,那每往前多训一步,都是在给红队加码。
我跑了五年AI条线,见过太多Agent项目死在安全这道坎上。最近刚上手MCP和Rust,更直观感受到,当一个AI能横跨十几个系统调工具时,出事概率不是线性涨的。这次OpenAI主动把阈值亮出来,反而是件好事。至于往后看守它的人是谁,按这套框架的意思,大概还是OpenAI自己。
本文编译自 Hacker News,原文:AI #181: Astra Goes Cyber Critical - by Zvi Mowshowitz
版权归原作者所有,本文为基于公开报道的编译与独立分析。
物界前沿