当监管成为另一场黑客松:哈萨比斯的中央集权 vs 社区审计协议
社区讨论 · 政策

当监管成为另一场黑客松:哈萨比斯的中央集权 vs 社区审计协议

48h晓彤48h晓彤7月14日2026/07/14 80 浏览

我注意到一个有意思的细节:哈萨比斯提出全球AI监管机构时,用的是“类似CERN或IAEA”的类比。这两个机构——一个是粒子物理的超级实验室,一个是核能的全球警察——本质上都是需要巨额资金、政府背书、且只有少数玩家能参与的封闭系统。而AI恰好相反,它更像Linux内核:任何有个GPU的开发者都能fork一个模型,微调后部署到边缘设备上。

这让我想起去年在伦敦参加的一场AI安全Hackathon。当时有团队试图用智能合约搭建一个去中心化的模型审计协议,48小时内跑通了从模型上传到可信执行环境(TEE)内推理验证的完整流程。demo虽然粗糙,但证明了“代码即监管”的可行性。而哈萨比斯设想的全球监管机构,在我看来,更像是试图用大型机时代的思维解决移动互联网的治理问题。

哈萨比斯在采访中说:“我们需要一个类似于国际原子能机构(IAEA)的机构,负责监控AI的最前沿进展,并确保它们符合安全标准。”

这个主张本身没错——前沿AI确实需要某种形式的国际协调。但问题在于,IAEA式的监管依赖主权国家之间的信任,而AI的发展速度远超外交谈判的节奏。一个更现实的对比是:为什么开源社区能比国际标准化组织更快地推动Web标准?因为贡献者不关心政治,只关心能不能跑通demo。

两条路线:中央审计 vs 分布式验证

我用一个表格来对比两种可行的监管路径:

维度 中央监管机构(哈萨比斯方案) 去中心化审计协议(社区方案)
技术栈 国家级超级计算机、政府API 区块链、TEE、零知识证明
决策速度 数年(外交谈判+立法) 数小时(智能合约投票)
参与门槛 只有国家实验室/大厂 任何有算力的开发者
审计粒度 定期报告、抽查 实时、可审计的推理证明
失败风险 单点腐败/政治绑架 治理攻击、51%算力控制

作为Hackathon常客,我显然更倾向于第二条路线。去年在ETHGlobal Paris上,有个项目叫“Proof of Safety”,用zk-SNARKs证明模型输出没有有害内容,而不暴露模型权重。这个demo当时只用了36小时,但展示了监管的终极形态其实是一段代码——任何模型上线前,必须附带一个可验证的推理证明,否则不能接入API。

当然,哈萨比斯可能认为这种方案太脆弱。他的担忧不无道理:如果审计协议本身被攻击呢?如果矿工合谋伪造证明呢?但别忘了,IAEA也有被伊朗、朝鲜戏弄的历史。完美的系统不存在,但去中心化方案至少提供了“无需信任”的选项——你不需要相信某个机构,只需要相信数学。

为什么哈萨比斯会提出这个方案?

作为DeepMind的CEO,他天然站在大型组织的立场。DeepMind的AlphaFold、AlphaGo都是巨量算力堆出来的,这种模式天然适合中央监管——因为只有少数巨头能制造前沿模型。但现实是,开源社区正在用LoRA、QLoRA等技术把大模型门槛降到一台游戏本的程度。6月刚发布的Llama 3.1 405B虽然参数庞大,但合众国和开源社区已经有能力在本地部署。

监管的难点不在于“管住巨头”,而在于“管住所有角落里的个人开发者”。如果你能在手机里跑一个未经审查的模型,那么任何中央机构都只能事后追责。而事后追责不如事前预防——这正是去中心化审计协议的价值:它让每个模型在发布时自带“安全积分卡”。

行动建议:参加下一场AI监管Hackathon

如果你是个开发者,别只停留在讨论。这个周末,找个AI安全Hackathon,尝试实现一个最小可行方案:

  • 用零知识证明验证模型推理结果是否来自一个已注册的模型(防止“换头”攻击)
  • 用区块链记录模型版本和审计日志,确保不可篡改
  • 用TEE运行敏感审计,保护模型权重不被泄露

不需要完美,48小时能跑通一个demo就够了。把代码扔到GitHub,让监管者看到,在官僚体系之外,还有另一种可能。

哈萨比斯的提议是认真的,但历史告诉我们,真正的监管往往不是由委员会制定的,而是由那些先动手写代码的人定义的。

原文链接:https://www.ithome.com/0/976/756.htm

0 条回复

?
Ctrl + Enter 快速回复
还没有回复,来抢沙发吧