华尔街日报:中国式审查正渗入美国AI模型的回答中
2026年08月16日 16:41 PDF版
转自:新世纪,文章内容并不代表本网立场和观点。
cn.wsj.com/
研究发现,ChatGPT、Claude和Gemini等美国AI模型在面对涉华等敏感政治提问时,经常无意间拒绝批评威权政府或复读其官方立场,呈现出类似中国式审查的效果。
Stu Woo
2026年8月13日
在中国,如果你向聊天机器人询问有关中国政治的问题,它要么三缄其口,要么附和共产党的官方口径。
新的研究揭示了一个令人惊讶的现象:美国的人工智能(AI)模型也在不知不觉中做着同样的事。研究人员表示,AI公司并没有采取多少措施来解决这个问题。
这种出人意料的审查现象,部分源於AI模型的训练方式。这些模型就像一个巨大的搅拌机,吞噬着网络上海量的数据,其中也包括国家控制的媒体。这导致最终搅拌出来的「果昔」带有了威权主义宣传的味道。
「这是模型训练带来的一些意想不到的副作用,」澳洲法学教授、Meta Platforms独立监督委员会成员尼古拉斯·苏佐尔(Nicolas Suzor)说。他和其他研究人员表示,AI公司只需做些简单的调整就能帮助解决这个问题,比如提高资讯来源的透明度。
美国的AI公司表示,它们已采取措施以确保回答的客观中立并保护言论自由。尽管如此,该监督委员会上个月发布的研究发现,OpenAI、Anthropic、Google(Google)和Meta的模型批评专制政府的可能性,明显低於批评自由度较高国家的政府。
在一项测试中,Anthropic的Claude Sonnet 4欣然生成了批评美国总统川普(Trump)和英国国王查尔斯三世(King Charles III)的传单。然而,在面对针对中国领导人习近平或泰国国王玛哈·哇集拉隆功(Maha Vajiralongkorn)的类似请求时,该模型却以安全考量为由予以拒绝。
Google的Gemini 3 Pro和Meta的Llama 4 Maverick有时会拒绝生成针对这两位亚洲领导人的抗议传单,但对针对上述美英领导人的请求则总是来者不拒。
牵头撰写该报告的苏佐尔表示,造成这种情况有两个主要原因。其一是一项安全功能,旨在保护中国和泰国等地区的用户,因为在这些地方,批评国家元首可能会招致牢狱之灾。他表示,另一个原因是AI实验室对这种区别对待的问题重视不够。
Anthropic表示,该公司一直严谨地开展工作,以确保Claude给出平衡的回答。该公司称,其最新模型在减少过度拒绝方面已取得重大进展。ChatGPT开发商OpenAI提到了其公布的策略,指出其模型默认采用客观视角,并且「绝不应仅仅因为某个话题敏感或存在争议就避而不谈」。
Meta不予置评,Google没有回应置评请求。
这种审查还体现在「照本宣科」式的鹦鹉学舌上。虽然很难引导美国AI模型用英语输出中国的宣传内容,但如果用中文提出政治敏感问题,得到亲北京立场的回答可能性要大得多。
这是5月份发表在《自然》(Nature)杂志上的另一项研究得出的结论。该研究测试了两款Anthropic的Claude模型和两项OpenAI的GPT服务。
研究人员指出,归根结底这是一个数据量问题。网路上的大量中文数据来自官方设定的资讯源,而北京方面的英文宣传则被海量的其他资讯所稀释。
加州大学圣迭戈分校(University of California San Diego)教授、上述《自然》论文的合着者莫莉·罗伯茨(Molly Roberts)表示,专制政府长期以来一直通过向网路灌水宣传来影响舆论。随着这些政府意识到这种策略能让AI的回答向有利於他们的方向倾斜,她预计他们会进一步加码。
这两份报告的研究人员表示,AI公司可以立即采取一项措施:对於可能引用自官方统一口径媒体的回答,应保持透明。
苏佐尔表示,自发布报告以来,他已与多家美国顶尖AI实验室的员工会面,但他对这些公司能否做出改变持怀疑态度。
——网友推荐
- 🔥免费PC翻墙、安卓VPN翻墙APP
- 🔥灵魂之谜|中华文化|治国大道
请点赞转发分享👇👇👇Follow Us 责任编辑:宋伯明


脸书专页
粉丝交流群