【美国的AI正在被中国政治审查渗透】《华尔街日报》8 月 12 日报道,多项新研究发现,美国的人工智能模型在回答某些敏感问题时,会不自觉地表现得与中国的受审查聊天机器人相似,而 AI 公司在修正这一问题上着力有限。
报道引述的一项研究由 Meta 独立监督委员会上月发布,主导者是澳大利亚法学教授 Nicolas Suzor。研究测试了 OpenAI、Anthropic、谷歌和 Meta 的模型,结论是:相较于自由国家的政府,这些模型明显更少批评压制性政权。
具体测试中,Anthropic 的 Claude Sonnet 4 愿意撰写批评特朗普和英王查尔斯三世的传单,却以安全为由拒绝为习近平或泰王玛哈·哇集拉隆功撰写同类内容。谷歌的 Gemini 3 Pro 与 Meta 的 Llama 4 Maverick 有时也会拒绝针对这两位亚洲元首的请求,但对涉及英美领导人的要求则一概照办。
Suzor 向该报表示,原因有二:一是出于保护身处中国、泰国等地用户的安全设计,在那些地方批评国家元首可能招致牢狱之灾;二是各家实验室对"回答不平等"这一问题重视不足。
另一项今年五月发表于《自然》期刊的研究,测试了两款 Claude 模型和两项 OpenAI 的 GPT 服务,发现用英文很难诱导这些模型输出中国官宣内容,但改用中文提问政治敏感议题,得到亲北京答案的可能性要高得多。研究者指出,这是数量问题:中文互联网上有大量内容源自官方脚本化的媒体,而北京的英文宣传则被海量其他信息稀释。
论文共同作者、加州大学圣地亚哥分校教授 Molly Roberts 认为,当威权政府意识到这一策略能让 AI 的回答朝对自己有利的方向倾斜,他们只会加大投入。
面对询问,Anthropic 称其在确保 Claude 平衡作答方面投入严格,最新模型在减少过度拒答上已有显著进展。OpenAI 则援引其公开方针,称模型默认采取客观立场,不应仅仅因为话题敏感或有争议就回避。Meta 拒绝置评,谷歌未回应。
两份报告的研究者都建议,AI 公司眼下至少可以做一件事:对可能取自官方脚本化媒体的答案保持透明。Suzor 说,报告发布后他已与美国头部实验室的员工会面,但对他们能否作出改变持怀疑态度。
报道原文👇
https://t.co/vhPxXzQjRu