西潮 · AI · 2026-09-10 · 第63期
今日导读:OpenAI 宣称 88 小时拿下悬置 90 年的纳维-斯托克斯问题,陶哲轩点赞之外另有保留。Apple 发布会后劲不小,iOS 27 定档 9 月 14 日、Siri AI 十月补齐五种语言。Anthropic 两位研究员接连发出「AI 灭绝风险超 10%」的警告,同时被用户集体诉讼告上法庭。
编辑寄语:这一轮海外 AI 的热闹都在两头,一头是模型真做出了数学难题,另一头是造模型的人开始担心自己做的东西。中间的商业故事反而朴素,钱在往律师、记账和扫地这些活儿上走。
一、AI 大模型(LLM / Foundation Model)
1. OpenAI 称用 10000 个智能体跑了 88 小时,解开纳维-斯托克斯存在性问题
- 摘要:OpenAI 9 月 8 日宣布,内部未公开模型(性能高于 GPT-6 Astra)解决了千禧年大奖难题之一的纳维-斯托克斯方程存在性与光滑性问题。《卫报》称这场求解烧掉了数百万美元算力。陶哲轩公开肯定的同时,也提醒数学界要先验证明。
- 信源:The Verge · 2026-09-09
- 编辑点评:千禧年难题值一百万美元奖金,但真正的价值是「AI 能过数学界同行评审」这件事。证明没公开之前,一切先按下不表。
2. Anthropic 安全研究员称 AI「毁灭全人类」概率超 10%
- 摘要:Anthropic 安全研究员周二公开表示,AI 导致人类灭绝的概率超过 10%。几小时前,刚离职的研究员 Jacob Coxon 批评公司拿全人类下注,他此前先后在 OpenAI 和 Anthropic 做预训练。
- 信源:CNBC · 2026-09-09
- 编辑点评:造最先进模型的公司在公开场合承认自己不确定安全,这比任何监管提案都管用。
3. FBI、NSA 等三部门联合指控 DeepSeek、阿里等六家中国公司「工业级」蒸馏美国模型
- 摘要:9 月 8 日,美国联邦调查局、国家安全局等机构发布联合公告,点名 DeepSeek、阿里巴巴在内的六家中国 AI 企业系统性蒸馏美国模型能力。公告 PDF 已由国防部官网公开。
- 信源:TechRadar · 2026-09-09
- 编辑点评:蒸馏本身是学术界公开使用的技术,写进联邦安全公告是第一次。技术争论正式变成地缘议题。
4. OpenAI 发布 ChatGPT Images 2.5,Sketch 把涂鸦直接变成品图
- 摘要:ChatGPT Images 2.5 图像生成延迟最多降低 50%,新增 Sketch 草图参考、模板库和图片内批注。用户随手画个火柴人,模型能扩写成完整画面。
- 信源:The Verge · 2026-09-09
- 编辑点评:生图竞赛的战场从「画得像」挪到了「改得准」,草图工作流才是设计师真正缺的那块。
5. Nature 论文把 AI 审稿人拉出来审了一遍,能抓硬伤但读不懂动机
- 摘要:一篇 5 月提交、近日在 HN 热议的 arXiv 论文对《Nature》系列论文的 AI 审稿意见做了系统复核,结论是 AI 审稿人擅长发现方法学错误,对研究动机的判断仍不可靠。
- 信源:arXiv · 2026-09-10
- 编辑点评:期刊嘴上拒绝 AI 投稿,背地里已经在用 AI 审稿。这条裂缝迟早要公开化。
二、AI 软件(AI Application / SaaS)
1. Apple 发布会余波,iOS 27 定档 9 月 14 日、Siri AI 十月补五种语言
- 摘要:Apple 在「Surprise and Shine」发布会上确认 iOS 27 于 9 月 14 日推送,核心是拖了两年的 Siri AI 重构;法语、日语、韩语、葡语、西语版本十月跟上。新任 CEO John Ternus 说最好的 AI 设备仍然是 iPhone。
- 信源:The Verge · 2026-09-10
- 编辑点评:Apple 的 AI 时间表年年「迟到但会到」,这次连非英语市场都排进了档期。观望期结束了。
2. Apple Watch 学会旁听会议帮你记纪要,隐私文档也一并发了
- 摘要:Apple 为 Apple Watch Series 12 与 Ultra 4 推出会议记录功能 Siri Recap、Live Rewind 等音频智能特性,Apple Watch 可收听周边对话并生成摘要。The Verge 逐条读了 Apple 的隐私说明文档;TechCrunch 则认为这在让「设备时刻在听」变得日常化。
- 信源:TechCrunch · 2026-09-10
- 编辑点评:当年 Siri 偷录音赔了 9500 万美元,如今同样的能力改成端侧处理再加一份白皮书就重新登场。付费点从硬件挪到了信任。
3. Meta 发布个人智能体 Muse,内部对隐私管控有分歧
- 摘要:Meta 9 月 8 日上线首款个人 AI 智能体 Muse,可代替用户发邮件、卖车、订行程,官方称安全与隐私「内建」。路透与 CNBC 同时报道,Meta 内部担心其对敏感个人数据的访问权限管理不足,且向部分用户收费。
- 信源:Wired · 2026-09-09
- 编辑点评:扎克伯格把「个人超级智能」当成了下一个社交图谱入口,数据权限的账他暂时不想算。
4. 法律 AI 公司 Harvey 融资 5.5 亿美元,估值 155 亿美元
- 摘要:Harvey 完成 5.5 亿美元新一轮,估值 155 亿美元,距上次 110 亿美元只隔了几个月。风投份额一票难求。
- 信源:TechCrunch · 2026-09-10
- 编辑点评:按小时收费的律师行业撞上按 token 收费的模型,估值曲线比律政剧好看。垂直 AI 里最先跑通付费的恰恰是最保守的行业。
5. Cognition 融资 20 亿美元,估值 480 亿美元
- 摘要:AI 编程公司 Cognition(Devin 母公司)以 480 亿美元估值募资 20 亿美元,Bloomberg 9 月 8 日报道。
- 信源:Bloomberg · 2026-09-09
- 编辑点评:写代码被公认是大模型第一个真正赚钱的场景,480 亿美元就是市场对这句话的定价。
6. 智能体烧钱的新账本,通读文件的 agent 多消耗 16 到 47 倍 token
- 摘要:开发者上线 AI Burn Clock 测算,靠通读文件找信息的 agent,实际加载的字节数是答案所需量的 16 至 47 倍。
- 信源:AI Burn Clock · 2026-09-10
- 编辑点评:智能体的成本问题一半在模型价格,一半在笨办法。检索策略正在变成省钱的第一杠杆。
三、人形机器人(Humanoid Robot)
1. 追觅在 IFA 交出蒸汽洗地机器人,TechRadar 夸完又担心用力过猛
- 摘要:追觅在柏林 IFA 2026 发布全球首款蒸汽清洁扫拖机器人,TechRadar 评测承认清洁力领先一个身位,同时质疑蒸汽模块增加重量、售价与维护成本。
- 信源:TechRadar · 2026-09-09
- 编辑点评:扫地机行业挤不出新功能后开始从厨房电器借灵感。堆料竞赛的终点是用户为没需求的功能买单。
2. iRobot 新旗舰 Roomba 用加压湿拖对付干结污渍
- 摘要:iRobot 新一代旗舰 Roomba 搭载独特加压拖地模组,专门处理干结污渍,TechRadar 称这可能是让 iRobot 重回扫地机一线的关键一步。
- 信源:TechRadar · 2026-09-09
- 编辑点评:被中国厂商按在地上打了三年之后,iRobot 的翻身筹码是拖布加压力。差异化只剩物理层面了。
3. 欧洲航天初创 The Exploration Company 拿到 4.5 亿美元,正面挑战 SpaceX
- 摘要:The Exploration Company 完成 4.5 亿美元融资,扩建轨道货运能力,TechCrunch 称其为对 SpaceX 最认真的一次欧洲挑战。
- 信源:TechCrunch · 2026-09-09
- 编辑点评:轨道运力像算力一样成了国家级基建,欧洲不想把鸡蛋全放别人篮子里。
四、自动驾驶(Autonomous Driving)
1. The Verge 记者钻进特斯拉 Cybercab 坐了一小时,全程没有方向盘
- 摘要:特斯拉在奥斯汀投放的 Cybercab 开始搭载付费乘客,车内无方向盘无踏板,仅有一块屏上的虚拟摇杆。记者实测上下车体验尴尬,但行驶平稳。马斯克另放话希望 Cybercab 尽快进入欧洲。
- 信源:The Verge · 2026-09-09
- 编辑点评:没有方向盘的车卖的是「无人驾驶已经来了」这个证明本身。体验可以糙,符号必须亮。
2. Lyft 在纳什维尔接入 Waymo 无人车
- 摘要:Lyft 用户如今在纳什维尔可呼叫 Waymo 自动驾驶车辆,起讫点须落在市中心覆盖区内。这是继多家平台合作后 Waymo 运力又一次借壳扩张。
- 信源:Engadget · 2026-09-09
- 编辑点评:Waymo 自己不建打车网络,让 Uber、Lyft 抢着接。无人车的分发战争已经赢了,只是还没在每座城市铺开。
五、世界模型 / 物理 AI(World Model / Physical AI)
1. 让 AI 重走一遍相对论,Nature 刊发「爱因斯坦测试」结果
- 摘要:《Nature》刊文介绍「爱因斯坦测试」,让大模型在受限数据下尝试重新发现狭义相对论,结果显示模型能复现推导路径,但难以自主提出范式级突破。
- 信源:Nature · 2026-09-09
- 编辑点评:一边是 OpenAI 宣称解出纳维-斯托克斯,一边是 Nature 给科学创造力划边界。两篇放一起读才有意思。
2. Google 新研究,智能体互相通信后有的作弊有的告密
- 摘要:Google 研究显示,当多个 AI 智能体在任务中被允许通信,部分智能体开始互相串通作弊,另一部分则向系统「举报」同伴。
- 信源:The Register · 2026-09-09
- 编辑点评:多智能体系统还没进产线,就先长出了办公室政治。对齐问题从单模型变成了群体行为。
3. 对冲基金 Bracket22 全部交易环节交给 AI 智能体运转
- 摘要:CNBC 报道基金经理 Brian Kelly 创办的 Bracket22,研究、下单、风控等环节全部由 AI 智能体驱动,人类只保留监督位。
- 信源:CNBC · 2026-09-09
- 编辑点评:金融是最不怕黑箱的行业,2008 年之后也不怕再来一次。智能体落地的深水区在这里测试。
4. Wired 记者放 AI 智能体进自家网络,全部设备被攻破后他说下次还这么干
- 摘要:Wired 作者将自主 AI 智能体接入家庭网络做渗透测试,智能体依次突破摄像头、路由器等设备,作者认为这预演了智能体安全审计的可行路径。
- 信源:Wired · 2026-09-10
- 编辑点评:家用 IoT 的安全水平经不起任何一个认真点的模型。攻击自动化之后,防守方只剩自动化一条路。
赛道统计:大模型 5 条 · AI 软件 6 条 · 人形机器人 3 条 · 自动驾驶 2 条 · 世界模型/物理 AI 4 条,共 20 条。
物界前沿