物界前沿 · 资讯情报卡(雷锋网 · 2026/9/10)
DeepSeek V4.1 Flash发布,长上下文显存占用大幅降低
核心事实
- DeepSeek发布V4.1 Flash模型,采用CED与CSA2新架构。
- 运行时显存占用减少75%,持久缓存降至前代八分之一。
- 在DeepSWE基准测试中通过率达74.2%,超越部分竞品。
- 模型总参数552B,预填充阶段仅激活8B参数即可运行。
关键数据
75%显存占用降幅
1/8持久缓存占比
74.2%DeepSWE通过率
552B主干参数量
物界观察
DeepSeek通过架构创新而非单纯堆料,打破了长上下文Agent的高成本魔咒。显存与存储成本的断崖式下跌,意味着百万Token级应用将从实验室走向规模化商用。这种“以小博大”的稀疏化路径,可能迫使行业重新审视稠密大模型的性价比逻辑,加速低成本智能体的普及。
来源:雷锋网原文 ↗
物界前沿