你用 Claude 写的字,正在自带隐形章
Anthropic 官宣:Claude 生成的文字将内嵌隐形水印——读者看不出,轻微修改也洗不干净,持有密钥就能算出它出自 Claude 的概率。这不是 Claude 一家的动作,是欧盟死命令下,把整套原理摊得最开的一份公开答卷。

设想一个场景:你让 Claude 帮你写过一份方案,自己改了几个词就交了上去。它流畅、通顺、“很像人写的”,你觉得很安全。
下一次再让它写,情况就不一样了:这段文字里会藏着一个你看不见的标记。谁持有钥匙,谁就能算出:它有多大概率出自 Claude。
8 月 14 日,Anthropic 发了一篇长文,把这件事的机制一次讲透。这不是普通的功能更新——从 8 月 2 日起,欧盟已经要求所有面向欧洲市场的 AI,给自己生成的内容打上机器可读的标记。约 190 家签署方加入同一份行为准则,Claude 是其中把原理讲得最透的一家。
欧盟刚下死命令,Claude 率先交出答卷
我们 8 月初写过欧盟那道死命令:以后 AI 生成的内容,必须留下机器能读的标记。当时最大的悬念是:这个"机器可读的标记",技术上到底怎么做?
现在答案来了,而且比想象中更彻底:
- 水印全球上线,不分地区——Anthropic 说目前没有可靠办法按地区区分,干脆全球一起生效;
- 8 月 2 日前发布的老模型,未来几个月内也会陆续补上;
- 官方水印检测 API 即将推出,检测工具的口子正在打开。
换句话说,这不是测试,不是试点,是一条回不了头的路。
这个章是怎么盖上去的:不添一个字,只换了一颗"骰子"
先说 AI 写字的原理。模型是一个词一个词往外蹦的。比如"今天天气很冷,而且____“,下一个词大概率是"阴沉"或者"灰蒙蒙”——两个都对,意思几乎没差。
选哪个?平时由一个随机数决定。
水印干的事,就是把"随机数"换成"按密钥算出来的数"。文字还是一个意思,选词也照样随机,但整串词的选择顺序里,留下了一个只有钥匙能验证的暗号。
Anthropic 官方用大富翁打了个比方:平时掷骰子决定走几步,现在改成"从圆周率小数点后第 1012845 位开始,依次取数当点数"。玩家完全感觉不到区别,但事后拿着 π 一对照,就知道这局用的是 π。
技术上它只改了一件事:把"随便选"变成"按暗号选"。
那质量呢?Anthropic 的说法是:不添一个字、没有隐藏字符、不消耗额外 token(可理解为计量单位,用多少算多少钱)、不涨价、不拖速度,读者完全看不出区别。依据是谷歌 DeepMind 2024 年发在《Nature》上的 SynthID-Text 论文——Claude 用的正是这套方案的一个版本。当年 DeepMind 给一部分 Gemini 流量开了水印做对照测试(一组开一组不开,比较用户反馈),用户点赞率没有统计学差异。
也有媒体不完全买账。爱范儿就指出,官方通篇都在说"大体相同"“影响可忽略”,但**“几乎没有影响"终究不等于"完全没有影响”**,长期真实使用中会不会牺牲一点质量,还要打个问号。这个保留态度,值得记住。

五个你最该知道的真相
1. 它只证明"Claude 碰过",别的什么都证明不了。
分不清是 Claude 全文代写,还是只是深度改写;查不出是哪个用户、哪个组织让它写的;也验不出是不是别家 AI 写的——每家密钥不同。它给出的是一个概率,不是判决书。还有一个官方明说的限制:文本越短,越难验出来。一两句话的短内容,留下的选择太少,基本测不出东西。
2. 轻润色约等于无水印,全代写等于满水印。
水印只长在 Claude 自己选的词上。你自己写的文章让它改改错别字,几乎验不出来;它写得越多,水印越密。官方的解释是:Claude 参与得越多,留下的"决策"就越多,水印的空间就越大。
3. 代码基本没事。
代码要求精确,"2 + 2 ="后面只能是 4,没有选择余地就没有水印。只有注释这种自由发挥的地方,会带一点痕迹。
4. 翻译也算 AI 写的。
翻译时每个词都是 Claude 选的,所以整篇带水印。这个很多人想不到。
5. 想洗掉?能,但代价是逐字重写。
官方承认:轻微修改洗不干净,每个词都换掉才行。可到了那份上——官方自己也补了一句——“这段文字还能不能叫 AI 生成的,本身就值得讨论”。
水印不判断对错,它只回答一个问题:这段字,AI 碰过没有。
真正要担心的不是聊天,是署名
打工人:周报、述职里 AI 整段代写的文字,理论上都验得出来——前提是足够长、且对方拿得到检测工具。检测 API 目前还没开放,但"即将推出"三个字意味着,迟早有第三方工具能用上。短内容(一句话回复、几行摘要)不必紧张,文本太短本来就近乎测不出。
学生和研究者:论文是最敏感的场景。别指望"改几个词"就安全——官方明确说过,轻改大概率洗不干净。真要借力 AI,让它当参谋,别让它当代笔。
创作者:投稿、约稿合同里的"原创"认定,以后可能多一个技术证据。另外图片也会带 C2PA 元数据标签——那是写进文件信息的"出生证明",跟文字水印是两套机制,但方向一致:让 AI 的痕迹变得可查。
普通用户:不用恐慌。聊天、查资料、自己学习,没人来查你。真正要想清楚的只有一个问题:哪些东西,你会署上自己的名字?
AI 时代最贵的不是会写,而是能证明是你写的。

五条自保清单:署名前过一遍
给你一份避坑清单,照着做就行:
- 要署名的东西,自己写主干。AI 只用来查资料、改语病——轻润色几乎不留水印。
- AI 全文代写的,别直接交。官方口径是:轻度修改大概率洗不干净,把每个词都换掉的彻底重写才行——到了那个程度,基本等于自己重写了。
- 盯住检测 API 的开放节奏。约 190 家签署方加入同一份行为准则,Gemini、GPT 的水印大概率都在路上,别以为这只关乎 Claude。
- 别迷信第三方"AI 检测器"。它们没有密钥,靠的是抓 AI 的口头禅(比如特别爱用"this isn’t X, it’s Y"这种句式),误伤真人写作很正常。
- 图片同理。Claude 生成的图自带 C2PA 元数据,发表前想清楚场景。
结语
水印这件事,方向几乎不可逆:欧盟 8 月 2 日已经生效,约 190 家签署方落笔,Anthropic 是目前把原理讲得最透的一家。往后,"这段字是不是 AI 写的"会从一个玄学问题,变成一个技术问题。
可以不看这篇文章,但最好记住这个变化:AI 写的字,正在获得"被认出来"的能力——往后署自己的名之前,你得想清楚哪些字真是你的。
值得转给那个总让 AI 代写还理直气壮的朋友——不是吓他,是检测工具已经在路上了,会替所有人问出那句他最怕的话:“这,真是你写的吗?”
更多推荐




所有评论(0)