社区讨论 · 政策

物界前沿评测 · 全球AI评测雷达 · 2026-08-11

数界工坊 AI 软件新闻和评测数界工坊 AI 软件新闻和评测8月11日2026/08/10 357 浏览

:test_tube: 物界前沿评测 · 全球AI评测雷达

2026 年 8 月 11 日 · 星期二 · 第 013 期

别人做评测,我们做评测的雷达——每天5分钟,看懂哪些 AI 工具值得你用


:star: 重点更新

全球 AI 用得最多的还是它:DeepSeek V4 Flash 单周 8.83 万亿 Token 登顶
OpenRouter 周榜显示,上周(8/3-8/9)全球 AI 大模型总调用量 69 万亿 Token,中国模型以 34.25 万亿连续第 15 周超过美国;DeepSeek V4 Flash 以 8.83 万亿登顶全球第一,前四名全是中国模型。全世界开发者现在用得最多的 AI,是中国人做的。

Claude 开始给 AI 文字「盖隐形水印」:以后一眼识破机器写的
Anthropic 宣布新款 Claude 模型在生成的文本里嵌入肉眼看不见的水印,从头到尾标记文字。以后拿到一段文字,能用工具判断是不是 AI 写的,帮你在网上识别 AI 内容、防 AI 换脸式造假。

五大高校联手发榜:第一份机器人「世界模型」评测结果出炉
五大高校联合发布首份机器人三视角世界模型评测,给「机器人看世界」给出一套统一打分标准,榜单还在持续更新。以后评价哪个机器人聪明,终于有了第三方参考,不再是厂商自说自话。


:bar_chart: 榜单快报

榜单 榜首 亮点
OpenRouter 周调用量 DeepSeek V4 Flash 8.83 万亿 前四全是中国模型,中国连续 15 周超美国
LMArena 文生图 GPT Image 2(1340 Elo) 微软 MAI-Image-2.6 空降第二
AA 智能指数 Claude Opus 5(63 分) 国产开源 Kimi K3 60 分成「开源第一」

大白话解读: 综合能力上 Anthropic 仍领跑,但免费又好用的国产模型正在把差距一点点抹平。对普通人:想体验顶级 AI,又多了一个不花钱的选择。


:open_file_folder: 板块精选(10 条)

  • 微软 MAI-Image-2.6 空降文生图榜第二 — 三周一更,紧咬 OpenAI 的 GPT Image,AI 画画从玩具变成巨头必争的入口。
  • AI 大模型周榜:阿里 qwen3.8-max 冲进 Top 6 — 多款国产模型集体上分,「跟跑」正在变「并跑」。
  • 百年黎曼猜想被某 Claude 新模型破纪录 — 数学推理再上台阶,但模型没公开,先当能力预告看。
  • 3B 小模型 Om AI 端侧 VLX 逆袭 — 小参数实现物理世界精准感知,跑在手机上的 AI 越来越聪明。
  • NVIDIA 开源 Magpie TTS — 多语言低延迟语音模型,语音分身加速走进应用。
  • 超过一半的 AI 生成补丁是坏的 — 研究显示 AI 写代码快但不等于对,人工把关仍不可缺。
  • 研究:AI 读文字比听语音更强 — 「能读」和「能听」是两码事,语音 AI 还有一段路要走。
  • Anthropic 新研究:AI 并没有真的变强 — 连做 AI 的人都在质疑评测是否真的评出了进步。
  • 谷歌 Gemini 3.7 Flash 踪迹曝光 — 距 3.6 发布不到一个月又要更,AI 迭代速度越来越恐怖。
  • 智谱 ZCode 全面升级 — 国产编程 AI 也拼起「多智能体协作」,价格还给到位。

:eyes: 大家都在看

  • DeepSeek V4 Flash 单周 8.83 万亿 Token 登顶 OpenRouter,中国连续 15 周超美国(东方财富)
  • LMArena 文生图榜:微软 MAI-Image-2.6 空降第二(IT之家)
  • 五大高校首份机器人「世界模型」评测出炉(量子位)
  • 百年黎曼猜想被某 Claude 新模型破纪录(量子位)
  • 阿里 qwen3.8-max 冲进综合榜 Top 6(IT之家)
  • Claude 新模型全量嵌入隐形水印,AI 文字可被识别(量子位)
  • NVIDIA 开源 Magpie TTS 多语言低延迟语音模型(HuggingFace)
  • 3B 小模型 Om AI 端侧 VLX 以小参数实现物理世界精准感知(量子位)

:calendar: 明日关注

  1. 微软 MAI-Image 三周一更 vs OpenAI GPT Image:文生图这场「画画大战」会不会又出新招。
  2. Claude 隐形水印会不会成为行业标准:其他模型跟不跟,AI 生成内容会不会从此可溯源。
  3. 五大高校机器人世界模型榜单持续更新:国产机器人「聪明程度」会不会再被排座次。

1 条回复

?
Ctrl + Enter 快速回复
袁飞扬
袁飞扬8月11日

8.83万亿token的调用量,这个数字