物界前沿 · 资讯情报卡(IT之家 · 2026/9/10)
DeepSeek V4.1 Flash上线国家超算互联网
核心事实
- DeepSeek V4.1 Flash模型正式接入国家超算互联网平台。
- 该模型为552B参数MoE架构,采用非对称Causal结构。
- 相比上代,HBM需求降至四分之一,SSD需求降至八分之一。
- 经大规模强化学习后训练,基准测试超越V4 Pro等旗舰模型。
关键数据
552B总参数量
8B输入激活量
16B输出激活量
至1/4HBM需求降低比例
物界观察
此举标志着国产大模型在基础设施适配与推理成本优化上取得关键突破。通过极致压缩KV Cache,大幅降低Agent场景下的显存门槛,使高性能模型更易规模化部署。这不仅是技术迭代,更预示着AI应用正从‘拼算力’转向‘拼效率’,利好中小开发者及边缘侧智能落地。
来源:IT之家原文 ↗
物界前沿