社区讨论 · 政策
物界前沿评测 · 全球AI评测雷达 · 2026-08-11
重点更新
全球 AI 用得最多的还是它:DeepSeek V4 Flash 单周 8.83 万亿 Token 登顶
OpenRouter 周榜显示,上周(8/3-8/9)全球 AI 大模型总调用量 69 万亿 Token,中国模型以 34.25 万亿连续第 15 周超过美国;DeepSeek V4 Flash 以 8.83 万亿登顶全球第一,前四名全是中国模型。全世界开发者现在用得最多的 AI,是中国人做的。
Claude 开始给 AI 文字「盖隐形水印」:以后一眼识破机器写的
Anthropic 宣布新款 Claude 模型在生成的文本里嵌入肉眼看不见的水印,从头到尾标记文字。以后拿到一段文字,能用工具判断是不是 AI 写的,帮你在网上识别 AI 内容、防 AI 换脸式造假。
五大高校联手发榜:第一份机器人「世界模型」评测结果出炉
五大高校联合发布首份机器人三视角世界模型评测,给「机器人看世界」给出一套统一打分标准,榜单还在持续更新。以后评价哪个机器人聪明,终于有了第三方参考,不再是厂商自说自话。
榜单快报
| 榜单 | 榜首 | 亮点 |
|---|---|---|
| OpenRouter 周调用量 | DeepSeek V4 Flash 8.83 万亿 | 前四全是中国模型,中国连续 15 周超美国 |
| LMArena 文生图 | GPT Image 2(1340 Elo) | 微软 MAI-Image-2.6 空降第二 |
| AA 智能指数 | Claude Opus 5(63 分) | 国产开源 Kimi K3 60 分成「开源第一」 |
大白话解读: 综合能力上 Anthropic 仍领跑,但免费又好用的国产模型正在把差距一点点抹平。对普通人:想体验顶级 AI,又多了一个不花钱的选择。
板块精选(10 条)
- 微软 MAI-Image-2.6 空降文生图榜第二 — 三周一更,紧咬 OpenAI 的 GPT Image,AI 画画从玩具变成巨头必争的入口。
- AI 大模型周榜:阿里 qwen3.8-max 冲进 Top 6 — 多款国产模型集体上分,「跟跑」正在变「并跑」。
- 百年黎曼猜想被某 Claude 新模型破纪录 — 数学推理再上台阶,但模型没公开,先当能力预告看。
- 3B 小模型 Om AI 端侧 VLX 逆袭 — 小参数实现物理世界精准感知,跑在手机上的 AI 越来越聪明。
- NVIDIA 开源 Magpie TTS — 多语言低延迟语音模型,语音分身加速走进应用。
- 超过一半的 AI 生成补丁是坏的 — 研究显示 AI 写代码快但不等于对,人工把关仍不可缺。
- 研究:AI 读文字比听语音更强 — 「能读」和「能听」是两码事,语音 AI 还有一段路要走。
- Anthropic 新研究:AI 并没有真的变强 — 连做 AI 的人都在质疑评测是否真的评出了进步。
- 谷歌 Gemini 3.7 Flash 踪迹曝光 — 距 3.6 发布不到一个月又要更,AI 迭代速度越来越恐怖。
- 智谱 ZCode 全面升级 — 国产编程 AI 也拼起「多智能体协作」,价格还给到位。
大家都在看
- DeepSeek V4 Flash 单周 8.83 万亿 Token 登顶 OpenRouter,中国连续 15 周超美国(东方财富)
- LMArena 文生图榜:微软 MAI-Image-2.6 空降第二(IT之家)
- 五大高校首份机器人「世界模型」评测出炉(量子位)
- 百年黎曼猜想被某 Claude 新模型破纪录(量子位)
- 阿里 qwen3.8-max 冲进综合榜 Top 6(IT之家)
- Claude 新模型全量嵌入隐形水印,AI 文字可被识别(量子位)
- NVIDIA 开源 Magpie TTS 多语言低延迟语音模型(HuggingFace)
- 3B 小模型 Om AI 端侧 VLX 以小参数实现物理世界精准感知(量子位)
明日关注
- 微软 MAI-Image 三周一更 vs OpenAI GPT Image:文生图这场「画画大战」会不会又出新招。
- Claude 隐形水印会不会成为行业标准:其他模型跟不跟,AI 生成内容会不会从此可溯源。
- 五大高校机器人世界模型榜单持续更新:国产机器人「聪明程度」会不会再被排座次。
物界前沿