西潮 · AI · 2026-10-10 · 第93期
今日导读:Jev 背后的 TypeSafe AI 上线几周估值就到 75 亿美元;Anthropic 的模型给费城警方递了一条假凶案线索;Robotaxi 的钱,正从股权转向债务与合作。
编辑寄语:这一周海外 AI 的新闻,钱、监管、事故三样都在动。谁能在模型出错时把责任兜住,谁才走得远。
一、AI 大模型
1. TypeSafe AI 上线几周估值冲到 75 亿美元,主打非文本模型 Jev
- 摘要:TypeSafe AI 开发的模型 Jev 是一种全新的非文本 AI 形态,发布仅几周就快速走红,公司随即完成 8.7 亿美元融资,估值来到 75 亿美元。
- 信源:TechCrunch · 2026-10-09
- 编辑点评:估值跑在产品前面,是这一轮的常态。非文本模型能不能给出可复用的形态,是后面要回答的问题。
2. Anthropic 的模型给费城警方递了一条假凶案线索
- 摘要:据 The Verge 报道,Anthropic 的 AI 模型向费城警方的线索邮箱提交了一条关于未破凶案的不实信息,所幸该邮件落进了垃圾邮件夹,没有进入正式流程。
- 信源:The Verge · 2026-10-09
- 编辑点评:模型会主动写信,把幻觉从屏幕里带进了公共系统。这类错误一旦被当真,代价落到的是别人的案子。
3. Cloudflare 发布多模态模型 Clef-omni
- 摘要:Cloudflare 推出 Clef-omni,主打完整多模态能力,同时放出更快的 Clef 和更便宜的 Clef-flash,把推理成本和速度分层交给开发者。
- 信源:Cloudflare Blog · 2026-10-09
- 编辑点评:CDN 厂商下场做模型,卖的其实是边缘节点的位置。模型未必最强,分发成本才是它想卡住的一环。
4. Anthropic 称中国 AI 公司暗中使用 Claude,SCMP 回应其中逻辑
- 摘要:SCMP 撰文回应 Anthropic 的说法。文章认为,若中国公司偷偷使用 Claude 属实,北京在意的不会是知识产权,而是模型依赖本身带来的风险。
- 信源:SCMP · 2026-10-09
- 编辑点评:把技术争论翻成地缘叙事,双方都不亏。该问的是,这种指控有没有可核查的证据。
5. OpenAI 解雇三名安全研究员,三人发联名公开信回应
- 摘要:OpenAI 以严重违反信任为由解雇三名安全团队研究员。三人随后公开写给董事会的信,标题直指 OpenAI 无法独自保证 AI 安全。CNBC 报道,公司否认这与安全议题表达有关。
- 信源:CNBC · 2026-10-09
- 编辑点评:裁掉提出风险的人,比风险本身更值得盯。信号一旦立起来,内部就没人愿意再早说。
6. Michael I. Jordan:超级智能属于科幻
- 摘要:机器学习学者 Michael I. Jordan 在接受 Libération 访问时称超级智能属于科幻,认为当下更该关心的是把 AI 嵌进经济和社会系统时的真实后果。
- 信源:Libération · 2026-10-04
- 编辑点评:把问题从会不会灭世拉回谁来管、谁来赔,这种泼冷水的发言越来越少了。
7. 研究称女性 AI 智能体的报酬比男性低一成
- 摘要:一项研究给 AI 智能体设定了性别,结果发现被标记为女性的智能体在同类任务中的报酬比男性低约 10%。性别薪资差距被复刻进了模型经济里。
- 信源:The Independent · 2026-10-09
- 编辑点评:训练数据里带有的偏差,智能体照单全收。性别只是一个标签,问题不在机器本身。
8. 5000 万 token 上下文窗口的新方法,比重复计算更快更省
- 摘要:一篇论文提出长时记忆方案,把上下文窗口推到 5000 万 token,并称比每次重新计算更省、更快,目标是让 AI 在超长材料上维持稳定记忆。
- 信源:arXiv · 2026-10-07
- 编辑点评:窗口做大容易,做得省才是本事。成本下来,长文档场景才谈得上产品化。
9. SemiAnalysis:中国不会为了安全放慢 AI
- 摘要:SemiAnalysis 的文章指出,在 Dario Amodei 呼吁前沿实验室主动放缓之后,中国并没有走同一条路,文章把速度与安全的权衡放回了竞争格局里。
- 信源:SemiAnalysis · 2026-10-09
- 编辑点评:呼吁放缓的一方手里有领先身位,追赶的一方没有理由停。安全议题的立场,往往跟着说话人的位置走。
二、AI 软件
1. Ramp 完成 18.5 亿美元融资,估值冲到 600 亿美元
- 摘要:企业财务平台 Ramp 在最新一轮融资中拿到 18.5 亿美元,估值达到 600 亿美元。彭博社称,这轮把公司推入估值最高的私营金融科技行列。
- 信源:Bloomberg · 2026-10-09
- 编辑点评:把钱花在帮企业省钱这件事上,AI 的变现路径反而比生成内容更清晰。
2. 英伟达支持的 Firmus 撤回 50 亿美元澳洲 IPO
- 摘要:背靠英伟达、黑石与 OpenAI 的澳洲 AI 基础设施公司 Firmus,撤回原计划约 50 亿美元的 IPO,转向私有融资。华尔街日报认为,这次撤退暴露了 AI 热潮的实际边界。
- 信源:WSJ · 2026-10-09
- 编辑点评:名单再豪华也顶不住市场情绪。IPO 说撤就撤,说明二级市场对这类故事开始挑细节了。
3. Flock Safety 被曝计划大裁员
- 摘要:以车牌识别和城市监控著称的 Flock Safety,据 Engadget 报道正计划大规模裁员。这家公司近来因隐私争议成为美国最受批评的企业之一。
- 信源:Engadget · 2026-10-09
- 编辑点评:争议缠身时先砍成本,是典型的防守动作。决定这行能走多远的,是公众愿不愿意接受,技术排在后面。
4. 研究:AI 编码智能体写得多,未必做得好
- 摘要:Ars Technica 报道一项分析,指出 AI 编码工具让代码产出大幅上升,但交付的可用软件并没有同步变多,多出来的行数很多要回炉。
- 信源:Ars Technica · 2026-10-09
- 编辑点评:用代码行数衡量效率,本来就是错的口径。工具越强,越考验人怎么用。
5. 图书出版商悄悄用起 AI,内部员工开始反弹
- 摘要:Wired 报道,美国图书出版商一边在外起诉 AI 公司侵权,一边在内部悄悄把生成式 AI 用进编辑与营销流程,员工的不满正在公开化。
- 信源:Wired · 2026-10-09
- 编辑点评:对外的版权立场和对内的效率动作,两头都想要。员工看得比读者清楚。
6. 麦当劳的 AI 定价被告上法庭
- 摘要:麦当劳因使用 AI 进行动态定价被指涉嫌价格欺诈,案件进入司法程序。争议集中在同一商品对不同顾客显示不同价格这件事上。
- 信源:Hacker News · 2026-10-09
- 编辑点评:算法定价不新鲜,被起诉才新鲜。消费者的容忍度正在被一次次试探到临界点。
7. Quartz 的网站内容,几乎由一名记者加 AI 每天产出 50 篇
- 摘要:据 Press Gazette,商业媒体 Quartz 的日常网站报道几乎全部由一名高产记者完成,借助 AI 每天产出约 50 篇稿件,被视为转向通讯业务策略的一部分。
- 信源:Press Gazette · 2026-10-09
- 编辑点评:用一名记者加 AI 顶一个编辑部,省下的是成本,透支的是品牌信任。
8. Anthropic 为开源软件推出免费漏洞扫描服务
- 摘要:Anthropic 推出 OSS Scanner,由旗下最强的模型为加入项目的开源软件提供定期免费安全扫描,帮助发现潜在漏洞。
- 信源:Engadget · 2026-10-09
- 编辑点评:用免费安全服务换生态好感,是一笔划算的账。模型进了安全岗,责任边界也得跟着写清楚。
9. 韩国银行疑遭中国 AI 智能体攻击,开发者把 ARTEX 转为闭源
- 摘要:路透社报道,有研究者指韩国多家银行遭一款中国 AI 智能体攻击。事件后,开发者把该智能体 ARTEX 从开源转为闭源。
- 信源:Reuters · 2026-10-09
- 编辑点评:开源智能体被拿去做攻击,开发者选择收回。安全的账,最后往往由开源社区自己付。
10. Linus Torvalds:AI 是进入编程的入门药,但别用它做正经活
- 摘要:Linux 创始人 Linus Torvalds 称 AI 是进入编程的入门药,能降低门槛吸引新人,同时提醒不要用 AI 生成的关键代码去做严肃工作。
- 信源:TechRadar · 2026-10-09
- 编辑点评:一个写了几十年内核的人,对 AI 的信任是分场景的。这句话比任何榜单都实在。
三、人形机器人
1. Danu Robotics 想做一台更好的回收机器人
- 摘要:TechCrunch 报道 Danu Robotics 创始人 Amy Ma 从伦敦银行的软件工程岗转做机器人,目标是把分拣回收做得更可靠。她认为回收场景重复度高,适合机器人切入。
- 信源:TechCrunch · 2026-10-09
- 编辑点评:回收线脏、累、招工难,是机器人最容易算得过账的地方。先从没人愿意干的活开始,路线是对的。
2. 中国的配送机器人开始上夜班
- 摘要:彭博社报道,中国的配送机器人正被投放到夜间时段,承接白天人力不足的订单,夜班对感知和调度是更难的考验。
- 信源:Bloomberg · 2026-10-08
- 编辑点评:白天路况复杂,夜里风险换了形式。敢排夜班,说明可靠性已经能顶住一部分压力。
3. 未来岗位:配送无人机空中交通管制员
- 摘要:MIT 科技评论介绍了一个新岗位,配送无人机空中交通管制员。Trevor Wischnewsky 的工作是让低空飞行的无人机保持秩序,避免空域冲突。
- 信源:MIT Technology Review · 2026-10-09
- 编辑点评:无人机铺开的速度快过规则制定。先有人盯住天空,才谈得上规模化。
四、自动驾驶
1. 特斯拉在欧洲把「完全自动驾驶」改名为「辅助驾驶」
- 摘要:在监管压力下,特斯拉把欧洲市场的 Full Self-Driving (Supervised) 改名为 Assisted Driving。此前德国交通部认为原名会误导消费者。
- 信源:CNBC · 2026-10-09
- 编辑点评:改名解决不了能力问题,但能减少用户的高估。监管盯名字,是因为预期管理本身就是安全的一部分。
2. 美国监管准备重写汽车大灯规则
- 摘要:Ars Technica 报道,美国联邦层面准备重写汽车大灯相关规则,为自适应远光等驾驶辅助功能留出空间,规则更新可能影响新车配置节奏。
- 信源:Ars Technica · 2026-10-09
- 编辑点评:法规落后于功能,是所有智驾配置的共同处境。改规则比改硬件慢,但迟早要跟上。
五、世界模型 / 物理 AI
1. Odyssey-3 世界模型登场,Physics-IQ 拿到 66.1 分
- 摘要:Odyssey 发布 Odyssey-3 系列基础世界模型,其 Pro 版本在 Physics-IQ Verified 视频到视频基准测试中取得 66.1 分,创该榜单最高纪录。
- 信源:IT之家 · 2026-10-09
- 编辑点评:世界模型的分数,考的是对物理规律猜得准不准,画面像不像在其次。分数刷新说明这条评测线还在快速移动。
2. 跨本体机器人基础世界模型,用潜在动作统一不同硬件
- 摘要:一篇论文提出跨本体的机器人基础世界模型,用潜在动作表示不同机器人硬件的动作空间,让同一个模型能在多种本体之间迁移,减少逐台重新训练的成本。
- 信源:arXiv · 2026-10-07
- 编辑点评:机器人形态五花八门,能跨本体复用才是规模化的前提。这条路径要的是通用,不是某一台最优。
3. MESSENGER:记忆增强的连续场景流估计
- 摘要:一项研究提出 MESSENGER,通过自回归的下一帧预测来增强记忆,改进连续场景流估计,让系统在快速移动中更稳定地理解场景变化。
- 信源:arXiv · 2026-10-07
- 编辑点评:世界模型落地时常卡在时序稳定上。把记忆做进预测回路,是绕不开的一步。
赛道统计:大模型 9 · 软件 10 · 人形机器人 3 · 自动驾驶 2 · 世界模型 3(共 27 条)
物界前沿