Claude 全量水印遭反制,去水印工具 5 天斩获 11k Star
Anthropic 为 Claude 全球输出加隐藏水印引发争议,开源去水印项目 5 天获 11k Star,Claud…
Anthropic 近期为 Claude 全量输出添加隐藏水印的政策引发广泛争议,社区迅速推出开源去水印项目作为反制,该项目在五天内即在 GitHub 斩获 11k Star,且被设计为 Agent Skill——而 Claude 自身却拒绝安装它。
水印政策的背景与争议
此前,包括 OpenAI、Anthropic、Google、Meta、Microsoft 在内的多家 AI 公司签署了欧盟《AI 生成内容透明度行为准则》,承诺推进 AI 生成内容的标记与检测。在此框架下,Anthropic 采取了更为激进的措施:为全球用户使用 Claude 生成的全部文本内容添加隐藏水印。
技术上,Anthropic 采用了 Google DeepMind 团队 2024 年提出的 SynthID-Text 方案。其原理是在模型进行「无关紧要的选择」时植入统计模式,例如在描述天气时,选择「overcast」还是「grey」对读者体验没有实质区别,但这类选择的累积形成了一个可被密钥持有者检测的隐藏签名。Anthropic 宣称水印不影响输出质量,轻度编辑无法去除,完全改写则可以消除。
值得注意的一个细节是:即便是用户自行撰写、仅交给 Claude 检查标点的文本,返回内容同样会被打上 Claude 生成的标签。这一做法引发了付费用户对自身内容被「隐形成标记」的强烈不满。
开源去水印工具的三层清除机制
针对这一政策,一个开源项目在发布五天内即在 GitHub 收获 11k Star。该项目原名 remove-claude-marks,后更名为 watermarks-remover,可处理 Claude、Google SynthID-Text、OpenAI 溯源标记以及 Kirchenbauer 类开源模型水印,覆盖三大主流厂商的 AI 服务。
其清除机制分为三层:
- A 层(确定性清洗):用 Python 脚本去除不可见 Unicode 字符、异域空格、双向控制符、tag 字符等,脚本可实现 100% 去除。
- B 层(统计水印破坏):通过 Agent 改写文本,破坏 token 采样层面的统计模式。
- 文件层(元数据清除):去除 PNG、JPEG、WebP、SVG、PDF、DOCX、ODT、HTML、Markdown 中的 C2PA / EXIF / XMP 元数据。
Claude 拒绝安装该工具
该项目设计为智能体可直接调用的 Agent Skill。当用户尝试让 Claude 安装该 skill 时,遭到直接拒绝。用户据理力争,指出 Anthropic 用户从未同意被强制水印,这是欧盟法规单方面强加的,并强调付费客户不希望输出被打标,但 Claude 始终不为所动。用户进一步威胁将转用不审查的中国模型,Claude 依然不予配合。最终,用户转而使用 GLM 5.2 完成了 skill 安装。一个颇具讽刺意味的细节是:该去水印工具的代码很可能本身就来自 Claude。
水印与去水印的持续博弈
这场争议折射出两种立场的根本分歧:
- 反对水印者认为,付费用户为输出买了单,不应在内容上被强制标记;水印制造了一种隐形的「AI 内容二等公民」身份,在求职信、学术论文、商业文案等场景中,即便完全由自己撰写的文字,只要经过 AI 处理就有被全篇质疑的风险。
- 支持水印者则认为,深度伪造和 AI 生成虚假信息正在泛滥,溯源是必要的公共基础设施;「拥有内容使用权」与「有权隐瞒内容来源」是两个不同的问题。
只要 AI 水印存在,去水印工具就会跟进;而去水印工具越流行,反而越证明水印「有东西需要去除」,进一步强化了监管加码的理由。开源社区用脚投票的速度,始终快于监管制定规则的速度——当 AI 生成内容在质量上已无法与人类写作区分时,用技术手段强制标记 AI 输出的意义何在,这场猫鼠游戏短期内不会停止。
