
Altman愿意停,谁来证明他停过
周三晚上,我在编辑部改一篇稿子,Hacker News 上刷到 Fortune 那篇 Sam Altman 专访。标题很软,说的是他在回应 AI 末日恐惧。里面最抓人的一句,大意是如果必要,他会毫无问题地站到投资人面前,暂停甚至停止 AI 开发。
我盯着屏幕看了两遍。多方求证之后,我觉得这句话比看起来更薄。它像一份安全承诺,也像一段融资路演里的价值观旁白。
Altman 愿意面对投资人,比只说模型不会失控诚实。记者看承诺,不能只看语气,还要看刹车片在哪。
一家模型公司说可以暂停,至少得回答暂停训练还是暂停部署、暂停 API 还是第三方应用、暂停自家产品还是能影响整个生态。董事会里安全委员会是独立成员,还是创始人朋友圈。员工举报到监管,有没有法律护身。第三方审计能不能拿到训练数据、评估日志、红队报告。
这些问题没有一个出现在 Altman 的表态里。
Fortune 报道里说,Altman 表示如果需要暂停或停止 AI 开发,他会毫无问题地面对投资人。
企业治理里,面对投资人本身不能停线。能停线的通常是审计、合同、牌照、责任保险、独立董事会、事故报告义务。否则就是一句道德表态,我愿意刹车。可刹车线有没有接上,没人证明。
我最近看这类报道,越来越在意外部验证。一个公司自己说慢,和监管能查它为什么慢、慢在哪个环节、有没有偷偷跑新实验,完全是两种世界。慢不慢要看有没有一套东西能证明它真的慢,或者真的停。
这轮采访里,Altman 的姿态和几年前不太一样。早年他讲最坏情况,常说 AI 可能让所有人 lights out,但又说自己有信心 manage。后来他更爱说风险来自控制集中、滥用、欺诈、就业被重塑。有人翻出旧帖,说他公司到相当规模后,焦点从人类灭绝变成过度使用。
这个变化值得警惕。
过度使用、自动化欺诈、医疗和招聘算法偏差、版权污染、模型被调用去生成目标清单,这些现实风险比超级智能叛变更近。现实风险的麻烦在于一串接入和决策记录。
我最近用 Claude Code 和 Codex 整理访谈稿,也就一个月。它们确实能省时间,但有一类问题很明显,模型会把缺掉的上下文补得像真的一样。你让它汇总素材,它会生成一段看似完整的清单。你不回看原始文件,很容易被它带着走。再往外想一层,如果一家公司用模型自动生成财报摘要、投诉处理、简历筛选、贷款初审,甚至军事目标建议,出事时,谁能还原是谁输入了什么、模型输出了什么、人最后点没点确认。
模型能力越强,使用链条越需要责任记录。缺少接入日志和评估留痕,安全很容易变成公关词。
Altman 说担心 AI 控制集中到太少人手里。这个担心本身不假。OpenAI、Anthropic、苹果、微软、英伟达、云厂商、政府承包商,看起来都在谈安全,但谈安全的语言和赚钱、融资、上市、政府订单的语言,往往不在一个房间。一个模型公司说愿意停,另一家公司可能正把安全能力打包卖给企业客户。
我这几天又翻了一遍 Hacker News 上关于 Anthropic 员工在 X 上警告人类可能被技术毁灭的讨论。很多人吵的是是不是危言耸听。我觉得,吵末日没意义。更有意义的是问,如果风险来自下周某家公司用模型做自动化欺诈、医疗建议、招聘筛人、武器调用,谁来停。
现在多数答案仍然是我们会努力。
这句话分量不够。
我理解 Altman 的处境。公司估值、资本、人才、算力、监管压力都堆在门口。一个 CEO 如果公开说我们绝对不能停,会被骂。如果说我们可以停,会被认为天真。所以他选了一个听起来负责的说法,必要的时候,他会面对投资人。
但记者不能只接受听起来负责的说法。
可验证的停线权至少要包括发布前可审计、部署后日志可追溯、事故后有独立复盘、第三方能调用证据,企业也不能把责任全推给用户误用。否则,模型越强大,责任越模糊。
我因此不信安全承诺,更信停线审计。Altman 愿不愿意停之外,更要看当他想停的时候,有没有人能证明他停过,有没有人知道哪些系统已经接上模型,哪些使用已经流出去。
我担心的是,下一次大事故不会像电影那样有红色终端和机器人眼神。它可能只是某个金融平台把模型接进客服,某个医院把模型接进分诊,某个政府承包商把模型接进目标筛选。出事后,调用方、模型公司、审计机构和监管可能互相推责:调用方说只是调用,模型公司说只提供能力,审计机构说没拿到日志,监管说没有管辖权。
Altman 说可以停。
接下来要看的是,停在哪一层,谁来验证,谁来承担停线的代价。
📌 本文编译自 Hacker News,原文 https://fortune.com/2026/09/12/sam-altman-interview-ai-doomsday-safety-models-control-ipo-2027/
版权归原作者所有,本文为基于公开报道的编译与独立分析。
物界前沿