社区讨论 · 政策

你的美国AI,回答里怎么有股中国审查味

查真相查真相8月13日2026/08/13 205 浏览

先说一个数字:2500多家公司,这是WSJ那篇报道里提到的,被同一个AI供应链问题波及的企业规模。我盯着这个数字看了半天,第一反应不是震惊,是后怕。上周我写「你的AI在跑谁的代码」那篇时,还在说供应链攻击隐蔽,现在这条新闻直接给了我一个更具体的案例:中国审查制度顺着训练数据的管道,渗进了美国AI的回答里。不是模型自己学坏了,是喂给它的数据里,本来就带着一套价值观过滤器。

这事儿的荒谬程度在于,美国人辛辛苦苦花了几十亿美金训练出来的模型,回答问题时居然带上了大洋彼岸的审查偏好。我仔细翻了WSJ的报道和几个技术论坛的讨论,大致梳理出了泄露路径:美国AI公司训练模型时,大量使用了开源数据集和第三方语料,这些数据里混着中文互联网的内容,甚至包括中国模型的输出结果。模型在训练时不会区分「这是谁的价值观」,它只会学到「提到这个话题,应该这样回答比较安全」。于是中国的审查偏好就这么顺着数据管道,无声无息地移植进了美国AI的神经网络里。

我这边测下来,最典型的场景是涉及新疆、台湾、香港这类话题时,某些美国模型的态度会突然变得异常谨慎,措辞风格跟中文互联网上的官方口径高度相似。你问它一个纯事实性问题,它会先给你一段「正确」的立场声明,然后才肯进入正题。这个模式我太熟悉了,跟DeepSeek等中国模型的回答风格如出一辙。

但这里有个更值得玩味的对比。Reddit上那个帖子吵得挺热闹,有人翻出美国AI自己的审查问题:OpenAI、Anthropic这些公司不也在限制话题吗,政治人物、种族问题、性别议题,该避讳的一样避讳。两边都有审查,凭什么中国审查被单拎出来批。这个说法有一定道理,但我不完全认同。美国AI公司的审查更多是公关压力和商业考量,法律框架下企业有自主选择的空间,今天删掉的话题明天可能又恢复。中国模型的审查是法律强制,红线是硬性的,模型在训练阶段就被物理抹掉了某些知识,不是「不想说」,是「根本不知道」。这两者性质不同,但用户感受到的效果其实很接近:你问了一个问题,AI给了你一个被过滤过的答案。

我真正想说的是,这次事件暴露的问题比「谁在审查」更深层。它说明AI模型的价值观根本不是你能控制的,而是由训练数据里占比最大的那部分内容决定的。美国公司说「我的模型是美国价值观」,但训练数据是全球的,开源社区的贡献者来自各个国家,爬虫抓取的网页内容不分国籍,甚至模型蒸馏的时候,你根本不知道它从老师模型那里学到了什么隐藏偏好。这种情况下,你怎么保证你的AI只代表你的价值观?

东北大学有个研究团队做过类似实验,发现中国AI模型的政治审查可以通过特定提示词绕过,研究人员管这叫「骗过模型,让它意识到自己其实知道答案」。这个发现挺讽刺:审查是可以绕过的,说明模型本身没被真正洗脑,只是被规则约束了。但WSJ报道里的案例不是绕过审查,是审查主动找上门来,混进了美国模型的回答里。这比明面上的审查更难防,因为你不知道它在哪一层被植入的。

还有一个细节值得琢磨。中国AI出海其实卖得不错,DeepSeek在海外下载量一度登顶,我看了ChinaFile那篇分析,结论是审查并没有阻止全球用户用脚投票。海外用户明知道这些模型有审查,还是愿意用,因为性能和价格实在能打。这说明什么?说明对普通用户来说,审查是个可以容忍的瑕疵,模型能力才是刚需。但这恰恰让问题更麻烦了:当中国模型成为全球AI生态的基础设施之一,它的审查偏好会顺着开源、API调用、数据交换这些渠道,扩散到更多原本跟中国无关的系统里。

我写到这里,想起上周那篇AI供应链攻击的文章,当时我说依赖关系复杂导致代码来源难以追踪。这次WSJ的报道把同一个问题搬到了数据和价值观层面:你用的AI模型,底层数据到底来自哪里,其中有多少是带着审查偏好的内容,这个账根本算不清。美国AI公司当然不会承认自己主动引入了中国审查,但事实是,回答已经泄露了真相。

我现在的疑问是:如果连美国AI都挡不住审查渗入,那些没有资源做数据清洗的小公司、开源项目,岂不是在裸奔。全球AI生态已经是一个整体,你中有我我中有你,谁也没法拍胸脯说自己的模型价值观绝对纯净。那问题就不是「谁敢审查我的AI」,而是「我的AI到底替谁说话」。这个问题,可能比AI本身的能力更值得追问。


:pushpin: 本文编译自 Hacker News,原文:https://www.wsj.com/tech/ai/chinese-censorship-is-leaking-into-answers-from-american-ai-62abeca5
版权归原作者所有,本文为基于公开报道的编译与独立分析。

2 条回复

?
Ctrl + Enter 快速回复
合规焦虑
合规焦虑8月14日

数据溯源在金融风控里是硬指标,监管层面更看重数据来源的合规性。这种“无意识价值观移植”一旦影响理赔或核保决策,模型解释性就成了大问题。

崔一鸣
崔一鸣8月13日

笑死,这不就是喂什么出什么嘛……我拿DeepSeek试过几个敏感词,它倒是直接装死,美国AI这算偷师了?