物界前沿 · 资讯情报卡(IT之家 · 2026/9/10)

DeepSeek V4.1 Flash上线国家超算互联网

核心事实

关键数据

552B总参数量
8B输入激活量
16B输出激活量
至1/4HBM需求降低比例

物界观察

此举标志着国产大模型在基础设施适配与推理成本优化上取得关键突破。通过极致压缩KV Cache,大幅降低Agent场景下的显存门槛,使高性能模型更易规模化部署。这不仅是技术迭代,更预示着AI应用正从‘拼算力’转向‘拼效率’,利好中小开发者及边缘侧智能落地。

来源:IT之家原文 ↗

DeepSeek V4.1 Flash上线国家超算互联网 · 物界前沿