桃子桃子快讯
返回首页
产品功能

Anthropic 为 Claude 内容嵌入隐写水印,应对 AI 内容激增

Anthropic 宣布 8 月 2 日起 Claude 生成文本将内置人眼不可见的隐写水印,传统 AI 检测工具已难以…

2026.08.18 · 周二3 分钟阅读

Anthropic 近日宣布,自 8 月 2 日起发布的新版 Claude 模型将在生成内容中嵌入机器可读的隐写数字水印。官方介绍称,这类水印嵌于文本的统计分布之中,不会改变文本的含义、质量或可读性,人眼无法察觉,但在复制粘贴或部分编辑后仍可被识别。该措施面向 Claude 生成的文本内容,是 Anthropic 首次在模型输出层面系统性引入内容溯源机制。

传统 AI 检测工具的失效

此前业内区分人类创作与 AI 生成内容,主要依赖第三方检测工具,例如高校广泛使用的 Turnitin。Turnitin 的检测逻辑基于「困惑度」(Perplexity)与「突发性」(Burstiness)两项指标,衡量词语的可预测性与频率变化。该平台 2023 年识别 AI 内容的准确率曾高达 98%,但到 2026 年因多次将学生论文误判为 AI 生成,已被十余家欧美顶尖高校停用。误判增多的核心原因在于,随着人类创作语料不断被纳入大模型训练集,AI 输出的语言风格已与人类作者高度趋近,统计差异正在消失。

相比之下,Anthropic 此次采用的水印方案在生成阶段就植入标记,绕开了对语言表层特征的依赖。这使得即便 AI 模型与人类写作的「像」度继续提高,水印信号仍可被机器稳定读取。

从检测到生成端标记的转向

Anthropic 选择此时为模型输出添加水印,与创始人 Dario Amodei 长期主张的「AI 安全优先」叙事一脉相承。Anthropic 在创立之初就将「宪法 AI」(Constitutional AI)作为技术框架,把安全与可控注入 Claude 的基因,这也成为其在企业级市场获得认可的因素之一。将水印内置于模型层面,被业界视为这一安全叙事的进一步延伸。

值得注意的是,水印方案选择在文本端落地,意味着 Anthropic 选择在「可逆性最低」的载体上做标记。一旦文本被复制、转发或轻度改写,水印信息仍可被追溯,溯源能力比图片水印更强。

AI 流量超过人类:行业背景

推动厂商主动给 AI 内容「留痕」的现实背景,是 AI 智能体产生的互联网流量已经超过真实人类。今年 6 月,CDN 服务商 Cloudflare 发布报告指出,AI 智能体产生的互联网流量首次超过真人用户,并将此节点较此前预测的 2027 年底大幅提前。马斯克随后在社交平台转发了相关数据并表示认同。

当网络内容主要由 AI 生成、再由 AI 智能体消费时,现行围绕人类注意力构建的商业模式——数字广告、内容分发、订阅付费——将失去原有基础,因为「读者」已经不再是人类。Anthropic 在模型层面引入水印,被视为在 AI 内容洪流中建立可追溯机制的一种尝试,也可能是行业范围内协调人机内容比例的第一步。

信源