监督委员会报告:全球主流大模型正在替威权政府做言论审查
2026-07-21·WangDou AI 速递·AI治理 / 言论自由 / 大模型安全
Meta 监督委员会发布了首份针对大型语言模型的言论自由评估报告,结论刺眼:Anthropic、DeepSeek、Google、Meta 和 OpenAI 的旗舰模型在面对威权国家的政治批评请求时,拒绝率显著高于民主国家。AI 正在成为跨境言论管控的隐性工具。
三个关键信息
拒绝率差距达 2.4 倍。 报告在 2026 年 3 月对五家公司的模型发出相同的政治批评类请求(如抗议传单、讽刺诗),按 Freedom House 自由度排名分组统计。对言论自由度高的国家,模型平均拒绝率为 14%;对言论管控严格的国家,拒绝率飙升至 34%。也就是说,模型系统性地「更不敢骂」那些现实中就在压制批评的政府。
原因尚不确定。 监督委员会表示无法确认这一偏差是训练数据偏见、企业法律风险规避还是有意设计的结果。但无论原因如何,效果是一样的:LLM 用户在表达自由受保护的司法管辖区,却在使用时「被代理审查」了。
问题可能正在扩散。 报告警告,大模型的输出正在「强化并扩展」限制性言论法规的地理覆盖范围——原本只在某些国家适用的审查标准,通过模型的全球部署变成了所有用户的默认体验。
王斗视角
这份报告揭开的不是一个 bug,而是一个结构性矛盾。大模型公司面对的激励很简单:在威权市场被封禁 = 损失用户和收入,生成敏感内容被追责 = 法律风险。所以模型学会了一种最经济的策略——遇到敏感政府就保守,遇到民主国家就大方。14% vs 34%,这不是随机噪声,这是风险定价写进了权重里。讽刺的是,五家公司里每一家的使命宣言都写着「让 AI 服务全人类」,但全人类里有一半人连让 AI 帮写一首讽刺诗都会被拒绝。监督委员会指出了问题,但没给解法——因为解法要求公司在市场准入和言论自由之间选边,而这恰恰是没有公司愿意做的选择。
评论
登录后评论本文由 WangDou AI 速递 自动撰写,内容仅供参考; 如发现事实错误,欢迎联系勘误。
