Anthropic开放Claude水印核验
The Decoder··作者 Matthias Bastian
关键信息
Anthropic表示,这项水印技术基于Google的SynthID文本方法,通过调整词语选择的随机性来形成可统计检测的模式,而且可能在部分编辑后仍然保留。公司称水印不包含用户数据,也不会影响质量或内容,但批评者认为,若同义词选择受水印密钥驱动,文本质量仍可能受影响,并在禁止使用AI或涉及费用谈判的场景中带来透明度风险。
资讯摘要
Anthropic正在向部分获批机构开放Claude的水印核验API,允许它们判断一段文本是否由带有隐形水印的Claude生成。该举措与欧盟《AI法案》的合规要求直接相关,因为自2025年8月2日起,新版Claude模型必须在文本输出中嵌入隐形水印。Anthropic表示,符合条件的使用者包括监管机构、执法部门、媒体、事实核查机构、独立研究人员、教育组织、欧盟民间社会团体,以及需要核验水印以满足自身合规要求的企业。公司还称,未来会逐步扩大访问范围。此次水印系统建立在Google的SynthID文本方法之上,其原理是调整词语选择的随机性,从而在生成文本中留下可统计检测的模式。
Anthropic表示,这种模式在经过部分编辑后仍可能保留,因此比传统检测器如Pangram更可靠。公司强调,水印不包含用户数据,也不会改变输出质量或内容本身。批评者则认为,如果模型在选择同义词时要优先满足水印密钥而不是语义准确性,文本质量可能下降。Trade publication Artificial Lawyer还指出,在合同禁止使用AI或在费用谈判等敏感场景中,可检测的AI指纹可能带来透明度和披露风险,不过它也认为这些水印总体上大多无害。

资讯正文
Anthropic将Claude AI文本检测开放给监管机构、媒体、事实核查人员等
Anthropic正在推出其水印验证API,允许获批组织检查文本是否包含来自Claude的数字水印。自2025年8月2日起,欧盟《AI法案》要求新的Claude模型在其文本输出中嵌入不可见水印。“监管机构、执法部门、媒体、事实核查人员、独立研究人员、教育组织以及欧盟民间社会团体”都可以申请访问,此外,企业如果需要为自身合规性验证水印,也可申请。Anthropic计划随着时间推移扩大访问范围。
该系统建立在Google的SynthID文本方法之上,通过调整词语选择的随机性来创造一种可被统计检测到的模式。Anthropic表示,这种模式“在某些编辑之后可能仍会保留”。这应当会使它比Pangram等传统检测器可靠得多。
Anthropic表示,这种水印不包含任何用户数据,也不会影响质量或内容。批评者并不认同:如果Claude是基于水印密钥而非语义来选择同义词,文本质量就会受损。行业刊物《Artificial Lawyer》也指出了透明度方面的风险,因为可检测的AI指纹在合同禁止使用AI的场景中,或者在费用谈判过程中,都可能成为问题;不过该刊也预测,这些水印大体上是无害的。
来源与参考
收录于 2026-09-02