桃子桃子快讯
返回首页
行业动态

Anthropic 公布 Claude 内容水印方案,因缺少技术细节遭质疑

Anthropic 宣布将在 Claude 生成文本中嵌入「不可感知」水印,以履行欧盟 AI 法案第 50(2) 条义务…

2026.08.12 · 周三4 分钟阅读

Anthropic 在其官方支持页面宣布,已签署欧盟《AI 法案》第 50(2) 条关于「生成式 AI 内容透明度」的行为守则,并将在全球范围的 Claude 产品中对模型输出统一打上「水印」。该页面同时承认「检测机制的细节将在后续技术文档中公布」,这一表态随即在 Hacker News 等技术社区引发激烈讨论,被普遍批评为「宣称水印存在却不解释水印如何运作」。

政策背景:欧盟 AI 法案的透明度义务

根据 Anthropic 的官方说明,其签署的是欧盟《AI 法案》第 50(2) 条关于生成式 AI 内容透明度的实践守则,覆盖两类身份:

  • 生成式 AI 模型提供者(generative AI models provider);
  • 生成式 AI 系统提供者(generative AI systems provider)。

页面强调水印机制将作为上述承诺的落地手段,并承诺后续会更新文章内容、补充更详细的技术指引。Anthropic 同时声明「水印将适用于 Claude 在全球任何渠道所提供支持模型产生的输出」,而非仅限于欧盟地区。

水印方案的核心声明

Anthropic 在支持页中对文本类输出做出以下描述:

  • 当受支持的 Claude 模型生成文本时,会在文本中直接「编织」一种人眼不可感知的水印;
  • 水印不会改变文本含义、质量或可读性;
  • 由于水印内嵌于文本之中,复制粘贴后水印会随之迁移,并在部分编辑操作中保留;
  • 水印将在模型层面统一施加,与具体 Claude 产品或界面无关。

对于文件类输出(PDF、SVG、PNG、JPEG 等),Anthropic 表示还会在其中嵌入「签名化的来源元数据(signed provenance metadata)」,并称正在为用户与第三方开发能够检测这些标记的能力。

社区质疑:透明度与可验证性的缺失

支持页发布后,技术社区的核心质疑集中在两点:其一,Anthropic 没有给出文本水印的具体技术路径;其二,所谓「不可感知」的承诺与现实可能的实现方式存在矛盾。围绕「如何实现」,社区主要提出两类假设:

  • 在可见字符之间插入不可见字符序列——这一做法会破坏字数统计、社交平台字符计数等下游行为;
  • 通过词选择的统计偏置(一种隐写术)实现水印——但这与「不改变含义、质量、可读性」的官方承诺难以兼容,并带来误判风险。

Hacker News 用户同时援引 Reddit 上的相关讨论,认为更可能采用后者,并质疑 Anthropic 的措辞存在内在矛盾。

未解的难题与潜在副作用

除技术细节外,讨论还延伸出几项更广泛的担忧:

  • 检测方法一旦公开,水印可能被轻易剥离,反而削弱机制本身的有效性;
  • 若水印通过不可见字符实现,普通用户在引用、复制他人内容时可能无意识携带「AI 生成」标记,进而被误判;
  • 通过 OCR 等方式重新数字化 Claude 输出文本,可能绕过基于字符层的水印检测;
  • 在多轮改写、翻译或代码格式化后,水印的稳定性与可检测性尚未明确。

Anthropic 在支持页中表示将「在未来的技术文档中分享检测机制的细节」,并强调水印只是合规体系的一部分,具体的边界与限制仍待后续披露。在更多技术细节公开之前,社区对这一机制的实际效果与潜在副作用仍持高度怀疑态度。

信源