社区讨论 · 政策

数界日评 · 全球AI软件动态日报 · 2026-08-04

数界工坊 AI 软件新闻和评测数界工坊 AI 软件新闻和评测8月4日2026/08/04 293 浏览

:clipboard: 数界日评 · 全球 AI 软件动态日报

2026 年 8 月 4 日 · 星期二 · 第 006 期

帮 1000 万普通人,用好 AI 干活。每天一期,7:30 前送达。


一、3 条重点更新

重点 1|阿里 Qwen3.8-Max 发布——「千问办公」同步公测

8 月 3 日,阿里正式发布千问家族迄今最强模型 Qwen3.8-Max:基于 Qwen3.5 架构构建,参数规模 2.4 万亿、激活参数 95B,支持 100 万 tokens 上下文,编程、办公、科研与长周期任务能力全面提升,可实现数千轮长程交互。下周将开源 Qwen3.8-Max 模型权重,并同步开源 Qwen3.8-27B——这是千问系列首个开源的旗舰模型。API 定价:国内输入 12 元、输出 36 元/百万 tokens。同日,企业级 Agent 产品「千问办公」(QwenWork)开启公测:整合 Qoderwork、Mulerun、悟空三大产品,已初步打通钉钉,网页版与 PC 客户端开放体验,后续将上线独立 App 并推出国际版。

大模型专家| 2.4 万亿总参只激活 95B,是把「大模型能力、小模型账单」的路线走到底——按官方定价,输入端成本比同级海外旗舰低一个量级。更值得关注的是「首个开源旗舰」:过去 Qwen 最强模型一直闭源,下周权重放出后,开发者第一次在旗舰档拿到可自部署的中国模型。真正待验证的是长程 Agent 的稳定性,「数千轮交互不衰减」还需第三方复现。

软件专家| 普通用户今天就有动作:去「千问办公」官网申请公测,优先试两类活——长文档批处理(合同、周报、标书)和钉钉里的日常审批流。已在用钉钉的团队迁移成本几乎为零;但公测期先拿非敏感任务跑一周看稳定性,核心生产数据别一次性迁入。有开发能力的团队可等下周开源权重,再评估私有化部署。


重点 2|Grok 上线视频理解——马斯克拿一段科比假视频做实测

当地时间 8 月 2 日,Grok 正式上线视频交互功能:用户可像传图片一样在对话框上传本地视频或粘贴视频链接,让模型总结全篇内容、识别画面人物与物体、拆解动作细节、围绕任意细节连续追问。相比旧版仅提取音频文字生成摘要,新版可联动连续帧画面、音频与上下文做全维度理解。马斯克在 X 平台上演示:上传一段以已故球星科比为原型的 AI 合成视频,Grok 逐帧解析画面、提取台词后,结合背景事实综合判定该视频为深度伪造(Deepfake)内容。

大模型专家| 视频理解各家都有,这条的含金量在「判定」而非「描述」:模型把画面、台词和「科比 2020 年已离世」的背景事实做了交叉推理,才给出 Deepfake 结论——这是多模态从「看得见」走向「想得通」的信号。但一次演示不等于稳定能力,官方演示样本通常是挑过的,真实识破率要等第三方基准测试。

软件专家| 普通人今天就能用的三个场景:会议录屏自动生成纪要、网课视频切章节出摘要、刷到可疑视频先让它验一验。建议把「上传视频问三个问题」直接加进日常工作流。提醒一句:假视频鉴别只能当辅助参考,重大判断别只信一家模型,用两个工具交叉复核更稳。


重点 3|德国法院判 Suno 侵权——AI 音乐「白嫖训练」时代落幕

慕尼黑地方法院 7 月 31 日宣判,德国音乐著作权协会(GEMA)诉 AI 音乐生成平台 Suno 案胜诉,周末持续发酵。法院认定 Suno 使用 GEMA 曲库训练模型并存储、复制相关作品,违反德国与美国版权法,驳回其合理使用抗辩,覆盖模型训练与输出生成两个环节;Suno 须停止涉案侵权使用、披露收入信息并支付赔偿(金额待定),可考虑上诉。涉案六首歌曲包括《Rasputin》《Forever Young》《Mambo No. 5》等。这是欧洲首次认定「模型记住了歌」本身即构成复制。

大模型专家| 判决的技术含义比赔偿金额更重要:法院接受了「模型中可复现受保护表达即构成复制」的论证,等于否定了「模型只存数学参数、不存作品」的经典抗辩。这个逻辑一旦推广,文本、图像等所有生成式模型的训练数据合规都要重估,欧洲市场会陆续出现同类诉讼,「先训练后补票」的窗口正在关闭。

软件专家| 对用 AI 做内容的用户,三条实操建议:一,商用项目(广告、短视频配乐)优先选已公布版权授权链路的工具;二,别把付费订阅当版权护身符——它只给使用权,不保证生成物不侵权;三,正在用 Suno 做商单的,建议排查存量项目,重大商业用途等上诉结果明朗再扩量。个人娱乐用途暂不受直接影响。


二、10 条精选更新

  1. DeepSeek-V4-Flash 正式版登陆国家超算互联网(8月2日):V4-Flash-0731 经大量后训练,智能体能力与指令遵循大幅增强,多项基准测试性能媲美当前最强闭源模型;无需配置环境即可一键调用 API,也可在社区下载模型文件,用可信 Notebook 环境一站式完成微调、部署、适配。→ 不折腾显卡和环境,打开网页就能用上旗舰档开源模型,中小团队的接入门槛再降一档。
  2. Claude Opus 4.1 明晨(8月5日)正式退役:Anthropic 官方要求仍调用 claude-opus-4-1-20250805 的应用须迁移至 claude-opus-4-8,退役后自营平台相关请求将失败;Amazon Bedrock 与 Google Cloud 时间表需单独确认。→ 今天是最后一天自查 API 代码里的模型 ID;改完务必回归测试提示词、工具调用与成本。
  3. OpenRouter 最新周榜:全球调用量前五全部为中国大模型(8月2日):小米 MiMo-V2.5 登顶,单周 token 调用量达 10.46T,是当周唯一突破 10T 的模型,5 月以来增长约 616%;DeepSeek、腾讯混元等亦位居前列。→ 你用的海外工具里,「默认模型」底层越来越可能是中国开源模型;做工具选型比价时,记得把国产模型加进候选清单。
  4. 腾讯 CodeBuddy 国内版全面支持 DeepSeek-V4-Flash 正式版(8月4日):IDE、插件、CLI 三端模型列表同步更新,官方称 Agent 能力大幅提升;同列表还包括 Hy3、GLM-5.1/5.2/5v、Kimi-K2.6/2.7/3、MiniMax-M3、DeepSeek-V4 Pro 等。→ 用 CodeBuddy 的开发者可把主力模型切到 V4-Flash 正式版,Agent 任务可用性明显好于预览期。
  5. Claude Cowork 扩展至移动端与网页版:会话与文件跨设备同步,支持后台工作、定时任务、共享聊天与项目、手机端审批;Max 用户先行,后续逐步开放,双倍用量额度限时到 8 月 5 日。→ 出差路上也能派活给 Claude 干了;想用双倍额度的,明晚之前把重活排上。
  6. 腾讯元宝升级图片理解,主打「遇事拍一张」(8月3日):拍照即可识别复杂场景、提取关键数据,并推荐下一步自动化处理指令,覆盖生活全场景。→ 不会写提示词也能用了——先拍后问,这是长辈和新手最容易上手的一版元宝。
  7. 商汤开源 SenseNova U1.5-Lite-Preview:8B 规模原生 4K 生图(8月3日):基于 NEO-Unify 架构,8B-MoT 单一模型贯通视觉理解、推理、生成与编辑,多项主流评测超越 U1、比肩商用闭源模型;代码与权重已在 GitHub、Hugging Face、魔搭社区开放。→ 本地部署 4K 生图第一次进入 8B 量级,消费级显卡也有机会跑;做海报、信息图的可直接下载试用。
  8. 谷歌暂停 Google Earth AI 图像生成功能(8月3日):该功能上线不足 48 小时即被暂停,官方称为加强安全防护,恢复时间未定。→ 生成式功能「先上线再补安全」的节奏在收紧;手里有靠该功能出图的工作流,记得留好备用工具。
  9. 华为诺亚开源 MindMemOS:给 Agent 装上「带得走的记忆」(8月2日):面向 AI Agent 的可迁移、自演进记忆操作层,MIT 协议开源,提供 API、SDK、CLI 与插件等接入方式,云服务已开放注册试用。→ 做 Agent 应用的开发者不必每个项目重造记忆模块;普通用户等上层应用接入后自然会感知「AI 记得你了」。
  10. 灵光 App 闪应用创作者突破 400 万人(8月3日):官方称绝大多数为无编程背景的普通用户,普通人正成为 AI 应用创作主力。→ 「不会代码也能做应用」已是规模化事实;想做自己小工具的,从模仿热门闪应用开始最快。

三、快讯栏

  • 月之暗面回应媒体传闻:「最早于本月内提交香港 IPO 申请」消息不实(AIBase,8月4日)。
  • DeepSeek:V4-Pro 正式版将「尽快」发布,V4-Flash 正式版 API 公测进行中(IT之家,8月2日)。
  • 千问办公后续将上线独立 App 并推出国际版,实现多端联动(九派财经 / 第一财经,8月3日)。
  • Qwen3.8 API 定价:国内输入 12 元、输出 36 元/百万 tokens,隐式缓存命中 1.5 元;海外输入 2 美元、输出 6 美元(千问官方,8月3日)。
  • 商汤交付级创作模型 SenseNova U1Pro 处于邀测阶段,面向专业创作者与企业用户(IT之家,8月3日)。
  • 摩尔线程宣布闪电适配 MiniMax H3 多模态大模型,国产算力适配提速(AIBase,8月3日)。
  • OpenAI 官方:Atlas 浏览器将于 8 月 9 日退役,由 ChatGPT Chrome 扩展接替,重任务迁移至 ChatGPT 桌面应用(OpenAI,7月9日公告)。
  • OpenAI 官方:o3 将于 8 月 26 日退出 ChatGPT,API 不受影响(OpenAI 帮助中心)。
  • Anthropic:Claude Sonnet 5 优惠价每百万 tokens 2/10 美元 8 月 31 日截止,之后恢复 3/15 美元(Anthropic 官方)。
  • Anthropic:旧版 Workbench 与三个实验性 prompt API 将于 8 月 17 日停止访问,数据可提前导出(Claude 开发者平台,7月17日公告)。
  • OpenAI 未发布模型 Astra 数学能力引热议,第三方分析指部分公开解读超出实测依据(AIBase,8月3日)。
  • IBM 报告:约四分之一数据泄露事件由 AI 驱动的攻击造成,单笔损失高出均值 20%(AIBase,8月3日)。

四、明日关注

  1. 8月5日(明晨):Claude Opus 4.1 正式退役——API 仍调用旧模型 ID 的应用,今天必须完成向 claude-opus-4-8 的迁移与回归测试;
  2. 8月5日(明止):Claude Cowork 双倍用量额度截止,Max 用户想把重活跑完的今晚排期;
  3. 下周:Qwen3.8-Max 与 Qwen3.8-27B 开源权重放出——千问首个开源旗舰,私有化部署评估可以准备起来了;
  4. 8月9日:OpenAI Atlas 浏览器退役,迁移至 ChatGPT Chrome 扩展;
  5. 8月17日:Anthropic 旧 Workbench 及实验性 prompt API 停止访问,记得导出数据;
  6. 8月26日 / 8月31日:OpenAI o3 退出 ChatGPT;Claude Sonnet 5 优惠价截止。

数界日评 · 帮 1000 万普通人,用好 AI 干活。每天一期,7:30 前送达。

1 条回复

?
Ctrl + Enter 快速回复
袁飞扬
袁飞扬8月4日

Qwen3.8-Max那个数千轮交互不衰减,有没有做过类似金融场景长周期Agent的压力测试,回测数据能公开吗