8 月 14 日,Anthropic 在官方 X 账号与官网发布 Claude 文本水印说明:未来新发布的 Claude 模型生成文本时,会嵌入机器可检测的水印。先看清时间线:这不是立刻覆盖所有回答。官方说明,2026 年 8 月 2 日之前发布的旧模型处于过渡期,将在未来数月逐步支持;已生成的旧文本不会被事后写入水印,具体模型何时启用尚未逐一公布。
水印藏在选择里,不藏在字符里
原理不是往文本中插入隐藏字符。Anthropic 采用 Google DeepMind 2024 年公开的 SynthID-Text 方法变体:生成时在多个同样合理的候选词之间随机选择,形成可供机器检测的统计模式;不添加隐藏字符,也不增加 token。也就是说,水印是“选择的痕迹”,而不是一段肉眼不可见的附加文本。
官方同时给了能力边界。水印只能估算文本是否曾有 Claude 参与,不能确认作者,不能识别其他 AI,也不能区分 Claude 原创与重度编辑。短文本、事实密集段落、轻量校对和精确代码的信号更弱;翻译通常涉及更多 Claude 实际选择的词,信号更强;完整重写可以去除水印。水印不携带用户、组织或聊天标识,无法追溯个人;检测 API 尚未上线,Anthropic 只说“近期”提供。社区讨论中把它误认为零宽字符或可追踪个人的标识,官方 FAQ 明确否认了这两种说法。
为什么是现在
时间点与欧盟监管直接相关。欧盟《AI 法案》第 50 条关于 AI 生成内容标记与检测的透明度义务,自 2026 年 8 月 2 日起适用;欧盟委员会 7 月 29 日更新的实践准则帮助签署者证明合规,但不取代法律。Anthropic 称,由于暂时无法按地区稳定限定,文本水印将全球应用。
需要区分的是,PNG、JPG、SVG 等受支持文件采用 C2PA 签名来源元数据,与文本统计水印不是同一套机制。
Anthropic 表示,内部测试未发现对内容、创造力或可读性的实际影响,速度影响可忽略,价格不变。这是公司自述。社区存在一些“近期输出质量下降”的主观报告,但没有独立证据能把这些变化归因于水印。
真正的不确定性在应用端。官方边界意味着,水印更适合作为“文本是否可能由 Claude 生成”的概率线索,不宜单独作为学校、招聘或版权争议的定案证据。检测 API 何时开放、结果如何呈现,将决定它能被谁使用、怎样使用。

TopsTip