物界前沿 · 资讯情报卡(IT之家 · 2026/9/17)
智谱GLM实现AI自建推理系统,国产集群吞吐提3倍
核心事实
- 智谱GLM团队披露递归自我改进实践,由GLM-5.3驱动Infra Agent。
- 该Agent在超10万张国产芯片集群上从零搭建生产级推理服务。
- 不到两周将端到端吞吐提升至初始基线的3倍,成本达主流GPU水平。
- 匿名模型Ox-Alpha上线6天Token调用量超62万亿,已投入真实使用。
关键数据
>10万张集群规模
3倍吞吐提升倍数
<2周优化耗时
62万亿6日Token调用量
物界观察
这标志着大模型从“被部署”转向“自运维”。AI不再仅是代码生成者,而是具备系统工程能力的闭环参与者。在国产算力背景下,通过算法优化抹平硬件差距、大幅降低单Token成本,是打破英伟达生态垄断的关键路径。这种“自我进化”的工程化落地,可能重塑推理基础设施的构建范式。
来源:IT之家原文 ↗
物界前沿