桃子桃子快讯
返回首页
行业动态

Anthropic 为 Claude 文本加不可见水印,应对欧盟 AI 法案

Anthropic 宣布 8 月 2 日起发布的 Claude 模型将为文本生成内容嵌入水印,并为图像附带数字签名元数据…

2026.08.16 · 周日3 分钟阅读

Anthropic 宣布,自 8 月 2 日起发布的 Claude 系列模型,其生成的文本将默认携带一种「不可见水印」,用于标识内容出自 AI;同时,Claude 生成的大部分图片将附带含有数字签名的元数据。此举主要是为响应《欧盟人工智能法案》(EU AI Act)对前沿模型输出可追溯性的合规要求。

水印的工作方式与覆盖范围

文本水印通过算法微调模型选词的统计规律,在输出中留下可被检测到的痕迹。Anthropic 表示,这种水印不会改变 Claude 回复的「含义、质量或可读性」,且「在经过一定编辑后仍可能保留」。图片方面,除少数情况外,Claude 生成的图像将携带可验证模型处理过程的元数据。

需要注意的是,水印只能给出「信号」,并非确凿证据:模型可能只是被用来总结或翻译人类原想法;而缺少水印也不意味着文本一定不是 AI 生成,因为短文本或经过改写、润色的段落可能已脱离可检测模式。

监管背景与合规时间表

这一调整直接源于 2024 年正式通过的《欧盟 AI 法案》。根据规定:

  • 自今年 8 月 2 日起,前沿 AI 模型提供商必须确保 AI 输出可被检测;否则将面临最高 1500 万欧元(约 1700 万美元)或全球年营业额 3% 的罚款。
  • 8 月 2 日之后发布的模型须立即达标;已在市场上线的模型则有宽限期至 12 月 2 日。
  • Anthropic 表示,其水印措施将在全球范围内的 Claude 输出中统一启用,而非仅限于欧盟区域。

学术界对水印有效性的分歧

研究界对水印能否真正遏制 AI 滥用意见不一。西北大学元科学研究员 Reese Richardson 指出,水印相对容易被剥离——用另一个模型改写即可去除,因此难以阻挡有意规避者。

卡内基梅隆大学研究科学评估的计算机科学家 Nihar Shah 则认为,如果厂商开放水印检测工具,且误报率足够低,仍可识别出相当一部分违规使用场景。已有先例:2026 年国际机器学习大会(ICML)在其中一条审稿通道中加入水印,自动标记出使用 AI 撰写评审意见的文本,最终识别出 506 名违反「禁止使用 AI」政策的审稿人。Shah 表示:「这表明虽然部分人可能谨慎地规避检测,但相当多的违规者只是简单地复制粘贴 AI 输出。」

待解的问题

水印能否在学术诚信、内容农场等「AI 灌水」治理场景中发挥作用,仍有待观察。其在短文本、跨语言翻译、深度改写等场景下的鲁棒性,以及检测工具的开放程度与误报率,将决定它在实际合规与内容治理中的真正可用性。

信源