3.1415926535——这串数字现在有了新用途。Anthropic 解释,Claude 生成文字时,模型每次都要从一串「合理候选词」里挑一个字,过去靠随机数决定;现在开了浮水印功能后,Claude 改用一组「密钥」来决定该选候选清单里的第几个字。官方举的例子就是圆周率:密钥从 2 开始读,接下来的字就依序取候选清单的第 6、第 5、第 3、再第 5 个选项。整个过程不会多留下隐藏字符,肉眼也读不出差异,唯一能解码的是握有那把密钥的人。
这套做法是 Anthropic 对 Google DeepMind 在《Nature》发表的 SynthID-Text 方法做的改良版。Anthropic 强调,浮水印不会拖慢生成速度,也不需要额外的 token,等于不会让使用成本变高——这是回应欧盟新的 AI 透明规则,要求 AI 生成内容必须可被标记识别。Anthropic 之后会发布一支 API,让人拿着密钥去检查一段文字「Claude 是否曾经介入」。
能抓到的,只是「碰过」,不是「写了多少」
浮水印的极限也讲得很白:它分不出这段文字是 Claude 从头写的,还是用户请它稍微润过稿。翻译文本一样会被标记。如果只是轻度编辑或文字太短,浮水印可能弱到侦测不出来;但反过来说,轻度编辑基本上洗不掉浮水印,Anthropic 直接建议,真的想拿掉,得整段重写。
代码是例外。Anthropic 说 code 的浮水印通常比一般文字薄弱,原因很直白:编程语言常常要求输出必须精确、没有太多「候选词」可选,没有选择空间,浮水印自然就打不上去。这也牵动一个现实问题——外界原本担心,如果能证明整份代码是 AI 生成,版权疑虑可能让人直接拷贝再修改。
图片走的是另一套逻辑:Anthropic 会在 metadata 里加上经过加密签章的标注,写明这是 Claude 产出的图。至于为什么一次对全球用户开放,而不是先在欧盟上线,Anthropic 给的理由是:目前没有把握能做到「依地区分开实装」,干脆让 8 月 2 日之后发布的模型全面套用浮水印,旧版模型则会在接下来几个月陆续补上。






