你有没有听说,从2026年8月2日开始,所有新发布的Claude模型生成的文字,都将自带一个隐形的"身份证"。

默认开启,全球生效,关不掉。

很多人一听"水印",第一反应就是文字里是不是藏了什么看不见的字符?格式一清就没了?

你可能会说我把生成的文本复制到记事本,然后再复制回来是不是水印就消除了呢?

不是,完全不是一回事。

Claude的水印不是加零宽字符、不是加可见字符、不是在文本里藏特殊符号,它不是往文本里塞东西,它是改了模型"选词"的方式。

简单说,Claude水印的核心思想就一句话:不在文字里藏东西,而是改变选词的"随机性来源。

Claude水印的原理

我拆开给你讲,它到底是怎么工作的。

大语言模型生成文字的时候,是一个词一个词往外蹦的。每个位置,模型都会有好几个"差不多合理"的候选词,比如"今天天气又冷又___",后面接"阴沉"或"灰蒙"都行,意思没差别。

选哪个?平时靠随机数。

水印就在这个随机数上动手脚:

  • 普通生成:随机数生成器 → 选哪个词
  • 水印生成:密钥 + 前文几个词 → 推导出一个"有规律的随机数" → 选哪个词

选出来的词照样是正常词,不会蹦出生僻字,你读着完全没感觉。但持有密钥的人,可以把整段话的用词序列拿去检验,看它符不符合"用这个密钥生成"的统计规律,符合的概率越高,说明Claude参与写作的可能性越大。

Anthropic官博打了个比方特别形象:

玩大富翁本来是掷骰子走步数,现在改用圆周率小数位来"掷"。对玩家来说,走法照样随机,游戏体验毫无变化,但事后你只要拿到走法记录和圆周率数字,就能反推这局是不是用圆周率"掷"的。

这套技术叫 SynthID-Text,是Google DeepMind 2024年发在Nature上的,思想源头可以追溯到Scott Aaronson 2022年的方案。

而Anthropic是第一家大规模部署到写作模型上的主流厂商。

官方承诺的几个"不"

Anthropic也怕大家抵制,他自己列了一堆保证,挑几个关键的:

  • 不影响质量:内部测试没看出对内容、创造力、可读性的影响。Google那边也做过A/B测试,点赞点踩率没统计差异
  • 不加隐藏字符:文本里没有任何隐形Unicode 不加价:不额外消耗token
  • 不可追溯个人:水印里不含用户ID、组织、会话信息,查出来也定位不到具体是谁
  • 复制粘贴甩不掉:因为水印织在文字本身的统计分布里,不是元数据,复制走也带着

它的局限(很重要)

水印远不是万能的,至少有五个明显盲区:

  • 短文本没用。 文本太短,统计样本不够,检测准确率大幅下降,一句话、一个标题基本查不出来。
  • 代码和纯事实内容基本无效。 代码里关键词是固定的,没什么可选空间,"2+2=4"这种唯一答案的内容,水印没法下手。
  • 全文重写能抹掉。 改几个词、调调标点没用,但让另一个AI从头到尾释义改写一遍,统计模式就被打乱了。有研究说单轮释义就能移除98%以上的SynthID水印。
  • 翻译会失效。 翻译成另一种语言,词全换了,水印自然没了。
  • 只能证明"可能经过Claude",证明不了"是人写的"还是"别的AI写的"。 水印检测是单向的:有=可能Claude参与过;没有≠人写的。

为什么Anthropic要搞这个

直接推手是欧盟AI法案第50条,8月2日正式生效。要求生成式AI提供商必须给输出内容打机器可读标记,违规最高罚1500万欧元或全球营收3%。大约190家机构签了配套的行为准则,包括Google、Meta、Microsoft、OpenAI。

所以这不是Anthropic良心发现主动搞的,是合规要求。全球生效也是因为技术上没法按地区拆分:模型在服务器端跑,总不能给欧盟用户一个版本其他地区另一个版本。

对未来的影响

这件事真正的分量,不在技术本身,而在于它标志着一个时代的结束: "AI生成内容完全无法分辨"的时代,过去了。

具体说几个方向:

  • 对内容平台和教育: 水印相当于给AI内容加了个"可查的身份证"。平台以后可以把检测接入审核流程,学校也可以用它来查作业是不是AI写的。但注意,只能当线索,不能当铁证:因为它可以被绕过。
  • 对版权和法律: “这段文字是谁写的”,变得可验证了,虽然只是概率性的。以后侵权纠纷、著作权认定的时候,水印检测会作为证据之一出现。但法律上的认定最终还是看"人有没有独创性投入",不是看有没有水印。
  • 对开源模型: 不带水印会成为开源模型的一个卖点。不想被溯源的用户,可能会流向本地部署的开源模型。这对开源生态是个微妙的利好。
  • 对AI内容治理: 现在AI产生的流量已经超过人类了(Cloudflare 6月数据)。如果网上内容大部分是AI写的,再被AI读,那现行的互联网商业逻辑(比如广告)就会出问题。水印是给"AI内容"打标签的第一步,长远看是在给整个互联网做"物种分类":哪些是人看的、哪些是给AI看的。
  • 攻防会持续升级: 水印和去水印是个长期军备竞赛。现在有统计水印,就有释义改写去水印;以后可能有更强的水印方案,也会有更强的破解工具。这跟DRM、反盗版是一个路数。

总的来说,Claude水印不是什么"抓AI代写的神器",它更像是AI内容从"野蛮生长"走向"可治理"的第一个技术基础设施。

就像纸币上的防伪标记:不能彻底杜绝假币,但让造假成本变高了,也让"这张钱是不是真的"有了一个可以验证的起点。

Logo

汇聚全球AI编程工具,助力开发者即刻编程。

更多推荐