物界前沿 · 资讯情报卡(TechCrunch · 2026/10/11)
纳德拉呼吁AI模型配备紧急制动机制
核心事实
- 微软CEO纳德拉在X发帖,提出AI需建立信任架构。
- 他主张将模型与调度系统分离,并外置控制与防护措施。
- 他要求每个模型动作都记录防篡改的人类可读证据。
- 他提出授权人员应能随时暂停或关闭执行中的模型。
- 他称应假设模型已被攻破,从一开始就加以遏制。
物界观察
纳德拉把AI安全从抽象原则拉到工程层面:分离模型与调度、外置控制、可中断执行。这等于承认现有大模型不可完全信任,对行业是信号——安全设计将成产品准入门槛,而非事后补丁。用户端也意味着未来AI服务可能默认带急停开关。
物界前沿