Claude 开始给文字加水印,有人因此退订了
为了符合欧盟《人工智能法案》,Anthropic 会在 Claude 选词时留下统计痕迹。公司说读者看不出来,也不影响质量。一部分付费用户不买账,已经取消了订阅。
Anthropic 本周说,未来的 Claude 模型会在生成的文字里带上水印:不是盖一层看得见的字,也不是塞隐藏字符,而是改「下一个词怎么随机选」。拿着钥匙的人可以估计这段文字有没有经过 Claude 之手。公司称,这是为了遵守欧盟《人工智能法案》,并且和其他几家大厂一样,签了 2026 年 7 月的欧盟「AI 生成内容透明度行为准则」。
同一周,Business Insider 采访了四位因此取消 Claude 订阅的用户。有人担心客户交付的代码或文案被标成「AI 处理过」,有人觉得自己写的东西只拿去校对,也会被打上标记。Anthropic 对 BI 说,宣布之后并没有看到退订上升。
水印怎么打上去
大模型一次只选一个词。写到「今天天气又冷又……」时,下一个词几乎不会是「甜」,但「阴」或「灰」都说得通。平时这种无关紧要的选择,靠随机数来拍板。水印换了随机数的来源:用一把钥匙,再加上前面几个词,决定这次选哪一个。读的人看不出差别,拿钥匙核对词序,就能给出「这段有多大可能是 Claude 写的」的概率。
Anthropic 说,它用的是 Google DeepMind 2024 年发表在《Nature》上的 SynthID-Text 一类方法,思路可以追溯到 Scott Aaronson 2022 年的提案。核心只有一句:水印改的是随机性的来源,不是逼模型去选它本来不会选的词。它不会突然冒出「nubilous」这种生僻同义词。
公司自己划的边界
- 对读者不可见,内部测试和人工并排评分都说质量没有差别。
- 不增加 token,不额外收费,对速度影响可以忽略。
- 不含个人信息,追不到某个用户、公司或某次对话。
- 事实句、必须写对的代码,几乎不下手。注释这类可替换的地方才可能留下痕迹。
- 只校对语法时,改动太少,往往检测不到;整段翻译则每个词都是 Claude 选的,会带水印。
- 轻改大概去不干净,每个词都重写才会消失。那时还能不能叫「AI 生成」,公司自己也存疑。
The Register 挖苦说,这更像是低成本的「表演式合规」:能被绕过,Anthropic 多半也不在乎,重点是向监管证明自己做了标记,还不涨服务成本。文章标题里那句改写的莎士比亚,「Shall I compare thee to a summer's afternoon」,就是在说这种选词会被轻轻推一把。
为什么有人要退
Anthropic 的博客写得很清楚:检测到水印,只说明 Claude 处理过 这段文字,不等于它是原作者。校对、翻译、摘要之后,痕迹仍可能留下。对一部分付费用户来说,这句话不是安慰,是警报。
水印只能回答:Claude 有多大可能参与过。它分不清「Claude 写的」和「Claude 大改过的」。
也有人支持透明标记。传播公司 The Narrative Company 联合创始人 Aadit Sheth 在 X 上说,读者应当能分辨这些话是不是一个人自己想的,水印是办法之一。另一些人认为,这有助于避免模型越来越多地拿 AI 文本再训练,导致质量下滑。
数字机构 Directa 创始人 Santiago Alessandro Rivera Martínez 这周也退了。他的理由更像策略:工作流如果完全绑在一家专有软件上,对方以后改规则、改功能、改限制,你只能跟着改。「我更希望工作里的 AI 层是可迁移的,不绑死一家。」
它证明不了什么
水印只能提高「Claude 参与过」的概率,不能证明是人写的,也不能认出别家模型——别人钥匙不同,方法也可能不同。短文本候选词太少,检测不稳;写得越长,把握越大。图片、SVG 这类文件走另一套:C2PA 内容凭证,写在元数据里,不改像素,任何能读 C2PA 的工具都能看。
检测接口还没上线。Anthropic 说很快会提供水印检测 API。2026 年 8 月 2 日之前发布的旧模型有过渡期,会在接下来几个月补上。公司还说,目前没法按地区稳定切开,所以全球一起开,后面会再评估。
Google 已用 SynthID 给部分生成内容加水印,OpenAI 也在支持的图像和音频上用 SynthID。X 则会给它判定为 AI 生成或篡改的帖子打「Made with AI」标签。
这是加工稿,不是原文逐字翻译。事实来自下方出处,没有添加未报道的数据或引言。Anthropic 官方说明发布于 8 月 14 日;The Register 与 Business Insider 的报道按北京时间计入 8 月 15 日。
出处 · 可点开原文
- How Claude’s text watermark works · Anthropic · 2026-08-14
- Anthropic says text watermarking scheme relies on inconsequential words · The Register · 2026-08-15
- Claude users are canceling their subscriptions, citing Anthropic’s new AI watermark · Business Insider · 2026-08-14 18:48 UTC