Anthropic News·· 2026-08-14精选AI 评分70
Anthropic 宣布 Claude 将采用基于 SynthID-Text 的水印以符合欧盟 AI 法案
How Claude’s text watermark works
AI 导读
Anthropic 宣布未来 Claude 模型生成的文本将包含不可见的水印,旨在配合欧盟 AI 法案及全球约 190 家签署方的《透明度实践准则》。该机制利用 Google DeepMind 2024 年发表的 SynthID-Text 方法,通过微调生成过程中的随机性选择来嵌入模式,确保人类读者无法区分水印与非水印内容,且不增加额外 Token 成本或降低输出质量。
核心事实在于水印不修改词汇语义,也不添加隐藏字符,而是改变决定下一个词来源的随机数种子(如从骰子改为圆周率序列)。这意味着检测器只能判断“文本是否由 Claude 参与生成”的概率,无法确认具体作者、组织或对话记录,也无法在短文本、高事实准确性段落(如代码逻辑)或经过重度人工编辑的内容中有效工作。此外,文件类输出将采用 C2PA 标准在元数据中附带数字凭证,与文本水印机制分离。
推断显示,由于 EU 法规过渡期允许旧模型延后实施,且 Anthropic 目前缺乏按区域精确控制的技术手段,因此采取全球统一上线策略。猜测认为,随着检测 API 向监管机构、执法部门及企业开放,行业将出现针对水印鲁棒性的对抗性测试,但彻底重写文本仍可能绕过检测,这要求后续工具需结合多种信号而非单一依赖水印。
推荐理由
澄清水印仅改变随机性种子而非内容,且无法追溯用户,直接校正对隐私泄露和检测能力的误判。
来源:Anthropic News · anthropic.com