物界前沿 · 资讯情报卡(钛媒体 · 2026/9/11)
DeepSeek V4.1 Flash上线,性能超Pro且价格下调
核心事实
- DeepSeek发布V4.1 Flash模型,采用非对称结构,原生支持多模态。
- 该模型显存需求降至上一代四分之一,实测输出速度达300至500 tokens/秒。
- V4.1 Flash在GPQA Diamond基准测试中得分90.9,全面超越V4 Pro。
- 官方下调定价,缓存命中输入价降至0.02元每百万token,高峰时段翻倍。
- 负责人崔添翼宣布V4 Pro请求将路由至V4.1 Flash并按新低价计费。
关键数据
552B总参数规模
90.9GPQA Diamond得分
0.02元/百万token缓存命中输入价
300-500 tokens/秒输出速度
物界观察
DeepSeek以“加量降价”策略重塑竞争格局,通过架构创新实现高性能与低成本的统一。此举不仅直接挤压同尺寸模型生存空间,更标志着AI行业从单纯参数竞赛转向极致性价比博弈。对于开发者而言,低成本高吞吐的API将成为构建Agent应用的首选基础设施。
来源:钛媒体原文 ↗
物界前沿