桃子桃子快讯
返回首页
产品功能

Anthropic 为 Claude 全球输出部署隐形水印,覆盖五条产品线

8 月 2 日起,Claude 所有产品文本输出内嵌隐形水印,全球生效,系首家主流 AI 公司大规模部署文本水印。

2026.08.11 · 周二5 分钟阅读

Anthropic 宣布,自 8 月 2 日起,Claude 所有产品线的文本输出将内嵌隐形水印,覆盖全球用户,并非仅限欧盟。该举措直接源于欧盟 AI 法案第 50 条对生成式 AI 提供商的透明度要求,但 Anthropic 选择把标记范围推向全球所有 Claude 产品,是首家在文本输出上大规模部署水印的主流 AI 公司。

双层标记机制:文本隐写加文件签章

Anthropic 设计了两层标记,分别应对文本和文件输出。

文本水印作用于模型层面。Claude 在生成 Token 时会引入一种不可见的统计偏置,使输出的统计分布偏离自然概率,肉眼无法察觉,但专业检测工具可以识别。这种偏置内嵌于文本本身,不依赖外部元数据,因此即便文本被复制、粘贴乃至部分编辑,水印仍可能保留。Anthropic 在官方文档中表示,水印「不会改变 Claude 回复的含义、质量或可读性」,但并未公开具体技术方案,外界无从验证。一种通行的水印思路是让模型在生成时按预设模式略微偏向某些 Token,Anthropic 大概率采用了类似路径,但拒绝披露更多细节。

文件溯源元数据针对 Claude 生成的 .svg、.png、.jpg 等格式文件,附加符合 C2PA(内容来源与真实性联盟)开放标准的数字签名,可识别文件是否经 Claude 处理及是否遭篡改。文本水印与 C2PA 元数据各司其职:前者覆盖所有文本输出,后者只附加在 Claude 支持处理的文件类型上。

覆盖五条产品线,全球生效

欧盟 AI 法案约束的是在欧盟市场上线的 AI 系统,Anthropic 将这一要求扩展至全球:

  • 适用产品:Claude Platform(API)、Claude、Claude Code、Claude Cowork、Claude Tag 五条产品线
  • 适用地区:在 Claude 提供服务的所有地区生效
  • 云端接入:通过 AWS、Google Cloud、Microsoft Foundry 接入的客户同样适用文本水印;C2PA 签名视各平台能力而定

时间安排分为两段。8 月 2 日当天及之后在欧盟上线的新模型必须在发布时即支持标记;8 月 2 日之前发布的旧模型有过渡期,合规截止日为 12 月 2 日。违规处罚最高 1500 万欧元或全球年营收的 3%(取较高者)。

四重局限:Anthropic 自己打预防针

Anthropic 在文档中详尽列出水印局限,几乎对每种可能的误读都做了预防性说明:

  • 有水印不等于 Claude 原创:用户用 Claude 校对、翻译、摘要或格式转换后,输出虽带水印但内容可能源自用户自己
  • 检测仅给出概率结论:检测到水印只能说明内容「可能经过 Claude 处理」
  • 水印可能衰减或消失:大幅编辑、改写、翻译、混入其他文字后可能不可检测;过短段落因文本量不足无法识别
  • C2PA 元数据可被剥离:已有开源移除工具可用,格式转换或重新保存后即丢失

更敏感的争议在于质量折损。学术研究记录了水印强度与文本质量之间的权衡,水印越强、越抗编辑,对输出质量的影响也越大;当模型对输出不够自信时,负面影响尤为明显。Anthropic 声称水印「不影响质量和可读性」,但因未公开技术方案,用户无法独立验证。

行业影响与待解问题

Anthropic 是首家在文本输出上大规模部署水印的主流 AI 厂商。Google DeepMind 的 SynthID 覆盖文本、图像与音频;OpenAI 曾讨论水印方案,但部署节奏更慢。Anthropic 同时承诺向第三方开放检测工具,这是其方案中较引人注目的一点。

付费用户无法关闭水印。对于用 Claude 代写邮件、起草内部文档的用户而言,输出从此携带可被识别的来源标记,可能加剧与 Anthropic 既有摩擦。对开源模型而言,「不带水印」是天然特征,对不希望输出被追溯的用户构成了切换的实际动机。

水印的最终价值取决于检测的可靠性和可得性。Anthropic 承诺的技术文档和检测 API 何时落地、检测精度如何、能否经受对抗性攻击,将决定这套标记机制是真正可用的透明度基础设施,还是仅限一份交给欧盟的合规文书。

信源