桃子桃子快讯
返回首页
产品功能

Anthropic 宣布 Claude 将为生成内容添加水印

Anthropic 将对 8 月 2 日起发布的 Claude 模型生成的文本与图像添加水印,以符合欧盟 AI 内容透明…

2026.08.18 · 周二3 分钟阅读

Anthropic 本月宣布,将对旗下 Claude 系列模型生成的文本与文件统一添加水印,以帮助用户区分内容是否来自 AI。该措施同时也是 Anthropic 履行欧盟「AI 生成内容透明度行为准则」的重要一步。新规将覆盖全球范围内通过 Claude API、Claude、Claude Code、Claude Cowork 以及 Claude Tag 等所有渠道生成的内容,并不局限于欧盟地区。

政策背景:欧盟透明度规范

欧盟委员会推出的「AI 生成内容透明度行为准则」要求,提供或部署 AI 系统的企业必须告知用户其正在与 AI 交互,并在 AI 生成内容中加入水印标识;同时,用户也应被告知是否接触到深伪视频、情绪识别或生物特征分类工具。据欧盟委员会披露,已有近 200 家机构签署了相关条款。Anthropic 在公告中表示,相关水印功能将「很快」公布供客户核验文本是否由 AI 生成的具体方法。

文本水印:基于选词模式

针对文本内容,Anthropic 采用了与 Google SynthID 系统类似的技术路径——通过模型在选词时嵌入人眼不可见的统计模式。只要文本长度足够,AI 检测工具就能识别出仅 Claude 模型会产生的特征信号。Anthropic 强调,水印嵌入在模型层面完成,因此无论内容来自哪个 Claude 产品或入口都会带有标记,且即便经过复制粘贴(例如从 Windows 记事本或 macOS TextEdit 中转存)也不会丢失。

  • 关键特点:水印嵌入词与词之间的空格、词序等不可见信号;
  • 覆盖范围:8 月 2 日及之后发布的 Claude 模型;
  • 质量保证:Anthropic 表示内部测试显示水印「对内容质量、创造力与可读性没有任何影响」。

图像水印:C2PA 加密签名

对于图像类内容,Anthropic 选择在 .png、.jpg、.svg 等文件元数据中附加加密签名的「出处说明」(Content Credentials),注明该文件由 Claude 生成或处理。这一机制遵循 C2PA 标准,该标准已被多家相机厂商与图像编辑软件采用,用于记录图像来源。一旦有人篡改元数据试图抹除 AI 出处,加密签名将自动失效,从而提示文件被修改过。

水印并非万无一失

Anthropic 在公告中也坦承水印存在局限:水印的存在只能证明「Claude 可能参与了内容生成」,无法区分「Claude 撰写了此文」与「Claude 进行了大量编辑」。例如:

  • 若用户将他人的文章交给 Claude 改写,输出会带水印,但事实与观点仍来自原作者;
  • 轻量编辑通常无法完全去除水印,但完全重写或大幅转译则可能消除水印;
  • AI 生成内容占比过小或经截图重新保存等情况,也可能导致水印缺失。

Anthropic 的此次部署是 AI 行业向内容可追溯方向迈进的最新进展。此前,Substack 与 Pangram 合作标注 AI 生成比例,Spotify 推出 AI Persona 标识 AI 音乐,LinkedIn 上线 AI 内容举报功能,Suno 也宣布让用户识别 AI 生成歌曲。随着主流厂商相继落地水印与认证机制,AI 内容溯源正逐步从行业倡议走向产品级标配。

信源