产品功能
Anthropic 为 Claude 文本添加不可见水印,应对欧盟 AI 法案透明度要求
Anthropic 宣布新 Claude 模型将在生成文本中嵌入不可感知水印,用于标识 AI 生成内容,并面向第三方提供…
2026.08.11 · 周二约 2 分钟阅读
Anthropic 近日宣布,将在新版 Claude 模型生成的文本中嵌入「不可感知的水印」,用以标识内容由 AI 产出。这是主流大模型厂商在 AI 生成内容透明度方面迈出的关键一步,也是其履行欧盟 AI 法案相关承诺的具体举措。
水印的核心特性
据 Anthropic 介绍,新加入的水印具有以下特点:
- 肉眼不可察觉,不改变文本原意或可读性;
- 在文本被复制、粘贴时随内容一同迁移;
- 在一定程度上「可能经受住轻度编辑」,但大规模改写、翻译或与其他文本混合后可能无法被检测。
Anthropic 强调,仅检测到水印并不能证明 Claude 是原始作者——用户使用 Claude 进行校对或翻译同样可能留下标记。
适用范围与第三方工具
水印功能将覆盖以下场景:
- 自 8 月 2 日起发布或更新的 Claude 模型,开箱即用;
- 旧版本模型后续也将陆续获得支持;
- 全球范围内通过 Claude 官方渠道及云服务商访问所产生的文本均适用;
- Anthropic 计划向第三方提供检测工具,便于出版机构、学校等独立验证。
行业背景与影响
AI 生成内容近年来在出版与教育领域引发持续争议。今年早些时候,Hachette 曾因涉嫌 AI 写作指控撤回小说《Shy Girl》;上月,犯罪小说《Call Me, I'll Hide the Body》也因 AI 写作疑云在成交后遭经纪人撤回。这些事件凸显出市场对 AI 内容溯源工具的迫切需求。Claude 水印有望为出版商、学校和高校提供新的调查手段,使「将 AI 写作冒充个人创作」的行为更难得逞。
并非首例:Google DeepMind 早已布局
Anthropic 并非首家推出文本水印的主流实验室。Google DeepMind 早在 2024 年便宣布在 Gemini 应用及网页端为生成的文本与视频嵌入 SynthID 水印,并于 2023 年先行推出图像版本 SynthID。两家头部厂商相继入局,意味着文本级 AI 水印正快速走向行业标配阶段。
