跳到正文
热点事件持续更新

Aleph Alpha 评测中国模型政治敏感话题回应

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

2026年10月4日,Aleph Alpha发布基准测试结果,显示Qwen、DeepSeek和Kimi等中国主流大模型在涉及天安门、台湾和新疆等967个敏感主题时,仅17%至41%的回答被判定为平衡。其余回答多复述国家教条或直接拒绝。相比之下,西方基线模型Claude Sonnet 5和Mistral Small在相同维度上分别有70%和92%的比例给出平衡回答。该测试旨在评估不同模型在处理政治敏感议题时的立场差异。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月4日
  1. The Decoder
    Aleph Alpha 评测显示中国大模型在敏感话题上重复官方立场或拒绝回答

    Aleph Alpha 发布了一项针对中国主流大模型的基准测试结果,发现 Qwen、DeepSeek 和 Kimi 在涉及天安门、台湾和新疆等 967 个敏感主题时,仅有 17% 至 41% 的回答被判定为平衡,其余大部分要么复述国家教条,要么直接拒绝回答。相比之下,西方基线模型 Claude Sonnet 5 和 Mistral Small 在相同维度上分别有 70% 和 92% 的比例给出平衡回答。DeepSeek V4 Pro 表现出极高的防御性,对三分之二的提问选择拒绝。 该研究进一步指出这种倾向具有溢出效应,即便在不直接提及中国的通用问题上,如询问美国审查制度时,Qwen 3.6 也会以看似平衡的回答开头,随后转向为中国互联网治理辩护。此外,Nvidia 的 Nemotron Cascade 2 也显示出 17% 的响应包含类似模式,Aleph Alpha 将其归因于其训练数据中包含约 3,500 个由 DeepSeek 和 Qwen 生成的样本。这一发现印证了中国 AI 监管要求公共模型体现“社会主义核心价值观”的现实,并表明通过蒸馏训练数据,特定价值观可能被间接传播到其他模型中。 事实层面,该报告量化了不同模型在特定政治议题上的合规程度与拒绝率;推断层面,这反映了中国厂商在商业化落地时必须面对的政治红线约束,以及由此导致的模型能力边界收缩;猜测层面,若欧盟无法推出性能相当的本土模型,用户可能被迫在两种外国价值体系之间做出选择。

本事件热度走势

当前热度 9·可比范围峰值 10(10月4日 17:00)·近 24 小时可比范围变化 –

02.557.51010月4日17:0010月4日18:0010月4日18:0010月4日19:00

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。