Anthropic 将推出 Claude 文本水印检测 API
The Decoder··作者 Matthias Bastian
关键信息
Anthropic 表示,这种水印不会影响 Claude 输出的内容、创意性或可读性,但在短文本、事实密集段落或代码中可靠性较低,且经过大幅改写后可能被去除。该水印只能表明 Claude 很可能参与了生成,但不能证明整段文本是否完全由 Claude 写成、是否经过人工编辑,也不能判断是否由其他 AI 模型生成。
资讯摘要
Anthropic 正在准备推出一个水印检测 API,供第三方开发者接入自家应用,用来识别文本是否由 Claude 生成。公司表示,该系统采用了 Google DeepMind 的 SynthID Text 变体,通过调整词元选择时使用的随机性来源来嵌入可追踪模式。Anthropic 称,这种水印不会影响模型输出的内容、创意性或可读性。公司同时说明了几个重要限制:在短文本、事实密集型段落以及代码中,检测效果会更差;如果只是人类纯手工修改,水印就不会保留;如果经过大幅改写,水印也可能被去除。
翻译任务则更容易保留水印,因为相关文本中的每个词都是由 Claude 选择的。Anthropic 强调,检测器只能表明 Claude 很可能参与过生成,不能证明文本是否完全由 AI 生成,也不能判断是否只是被 Claude 大幅编辑过。由于目前没有技术手段把这一功能仅限制在特定地区,Anthropic 选择全球上线,以符合欧盟《AI 法案》的要求。公司还表示,2025 年 8 月 2 日之后发布的所有模型都默认支持水印,旧版 Claude 模型也会在未来几个月逐步加入,并且文件会使用开放的 C2PA 标准通过元数据记录来源信息。

资讯正文
Anthropic 宣布推出水印检测 API,允许第三方检测 Claude 的 AI 文本
Anthropic 很快将提供一种水印检测 API,使第三方开发者能够将 AI 文本检测功能接入自己的应用。
该公司为其 Claude AI 模型采用了 Google DeepMind 在 2024 年发表于《Nature》的一种 SynthID Text 方法变体。这个水印会在选词过程中微调随机性来源,从而生成可追踪的模式。Anthropic 表示,这不会对“Claude 文本的内容、创造性水平或可读性”产生任何影响。Google DeepMind 曾在 2024 年用下面的动画可视化这一过程。
对于较短的文本,或事实密集、可替代表述不多的段落,这种水印的可靠性会更差。代码也是如此。纯粹的纠错——也就是由人类逐字逐词选择——同样不会带有水印。翻译则是另一回事,因为在这种情况下 Claude 会选择所有词语。Anthropic 在已发布的 FAQ 中表示,重度改写可能会把水印去掉。
该水印只能标记出 Claude 很可能参与了某段文本的创作,但无法判断 Claude 是写了全部内容,还是只是对其进行了大幅编辑;也无法判断文本是否来自人类或另一种 AI 模型。
欧盟监管推动全球上线
Anthropic 正在加入水印功能,以符合欧盟《AI 法案》的要求。与大约 190 个其他签署方一起,该公司于 2026 年 7 月签署了《欧盟 AI 生成内容透明度行为准则》。由于目前没有技术手段按地区限制这一功能,水印检测将全球上线。Anthropic 表示,公司正在持续探索更多选项,后续会有更新。
所有在 2025 年 8 月 2 日之后发布的模型都默认支持水印功能。较旧的 Claude 模型将在未来几个月内获得这一功能。对于文件,Anthropic 使用开放的 C2PA 标准,该标准会附加元数据而不改变文件本身。
Anthropic 的水印检测与 Pangram 这类外部 AI 检测工具的工作方式不同。这些服务无法访问 Anthropic 的密钥。相反,它们会扫描 AI 文本中的典型模式,例如带有明显特征的措辞或过度使用的词语。检查水印是一种根本不同的方法,而且在实践中应该会更可靠。
来源与参考
收录于 2026-08-15