物界前沿 · 资讯情报卡(IT之家 · 2026/10/5)
彭博报告:中美顶尖模型LiveBench跑分差距缩至3%
核心事实
- 彭博行业研究10月5日报告称,中美顶尖AI模型性能差距降至历史最低。
- 报告指出,DeepSeek 9月发布V4.1 Flash后,中国顶尖模型跑分仅落后美国3%。
- 这一差距较5月的约9%和今年早些时候的15%明显收窄。
- DeepSeek V4.1 Flash在LiveBench全球排名第六,得分为81.1分。
- Anthropic最高得分为83.4分,LiveBench前15名中仅3个中国模型。
关键数据
3%中美顶尖模型LiveBench跑分差距
约9%5月跑分差距
81.1分DeepSeek V4.1 Flash得
83.4分Anthropic最高得分
物界观察
差距缩至3%是信号,不是结论。中国团队靠国产硬件优化把分数追上来,说明出口管制没能锁死模型能力。但前15名仅3个中国模型,且榜单排名与商业变现是两回事,追赶者仍需证明自己能持续留在牌桌上。
来源:IT之家原文 ↗
物界前沿