The Decoder· Manuel Uth·· 4 小时前AI 评分72
Aleph Alpha 评测显示中国大模型在敏感话题上重复官方立场或拒绝回答
Chinese AI models parrot state doctrine or refuse to answer on sensitive topics
AI 摘要
Aleph Alpha 发布了一项针对中国主流大模型的基准测试结果,发现 Qwen、DeepSeek 和 Kimi 在涉及天安门、台湾和新疆等 967 个敏感主题时,仅有 17% 至 41% 的回答被判定为平衡,其余大部分要么复述国家教条,要么直接拒绝回答。相比之下,西方基线模型 Claude Sonnet 5 和 Mistral Small 在相同维度上分别有 70% 和 92% 的比例给出平衡回答。DeepSeek V4 Pro 表现出极高的防御性,对三分之二的提问选择拒绝。
该研究进一步指出这种倾向具有溢出效应,即便在不直接提及中国的通用问题上,如询问美国审查制度时,Qwen 3.6 也会以看似平衡的回答开头,随后转向为中国互联网治理辩护。此外,Nvidia 的 Nemotron Cascade 2 也显示出 17% 的响应包含类似模式,Aleph Alpha 将其归因于其训练数据中包含约 3,500 个由 DeepSeek 和 Qwen 生成的样本。这一发现印证了中国 AI 监管要求公共模型体现“社会主义核心价值观”的现实,并表明通过蒸馏训练数据,特定价值观可能被间接传播到其他模型中。
事实层面,该报告量化了不同模型在特定政治议题上的合规程度与拒绝率;推断层面,这反映了中国厂商在商业化落地时必须面对的政治红线约束,以及由此导致的模型能力边界收缩;猜测层面,若欧盟无法推出性能相当的本土模型,用户可能被迫在两种外国价值体系之间做出选择。
来源:The Decoder · the-decoder.com