物界前沿 · 资讯情报卡(IT之家 · 2026/10/5)

彭博报告:中美顶尖模型LiveBench跑分差距缩至3%

核心事实

关键数据

3%中美顶尖模型LiveBench跑分差距
约9%5月跑分差距
81.1分DeepSeek V4.1 Flash得
83.4分Anthropic最高得分

物界观察

差距缩至3%是信号,不是结论。中国团队靠国产硬件优化把分数追上来,说明出口管制没能锁死模型能力。但前15名仅3个中国模型,且榜单排名与商业变现是两回事,追赶者仍需证明自己能持续留在牌桌上。

来源:IT之家原文 ↗