桃子桃子快讯
返回首页
行业动态

Anthropic 版权和解 15 亿美元,全球大模型数据合规进入新阶段

美国法院批准 Anthropic 15 亿美元和解,同时划清训练数据抓取与盗版囤积的法律边界,全球 AI 公司版权压力骤…

2026.07.28 · 周二4 分钟阅读

美国加州北区联邦法院近日正式批准作家群体诉 Anthropic 集体诉讼和解方案,这场持续两年的版权拉锯战以 15 亿美元落槌。高额和解金之外,真正撼动行业的是判决背后的法律逻辑:法院将 AI 仅抓取训练但不留存副本,与批量爬取并永久囤积素材这两种行为切割为两个独立的法律问题——合法阅读抓取可以免责,非法获取囤积必须重罚。

15 亿美元究竟赔了什么:盗版囤积被判核心侵权

这笔和解金的核心指向 AI 训练数据获取方式的合法性问题。主审法官 William Alsup 在 6 月 23 日的简易判决中提出关键意见:将 AI 数据抓取行为划分为两种性质——一是通过官方渠道购买正版书籍、仅用于训练且不留存底本的合规行为,属「合理使用」;二是批量爬取盗版资源并永久存档的侵权行为,不能以合理使用为挡箭牌。

法官的逻辑在于,即便 Anthropic 囤积盗版书籍的初衷是训练模型,但盗版副本的存在本身就构成对正版市场的潜在威胁,蚕食作家版税与出版社营收。前科幻杂志编辑魏先生表示,作品一旦公开便附带创作者设定的规则,AI 未经许可抓取确实侵犯了作者权利,此次判决为法律边界清晰化迈出了关键一步。

三条生死红线:法院为 Anthropic 划下整改要求

15 亿美元和解并不意味着高枕无忧,法院同时对 Anthropic 设下三条不可逾越的红线:

  • 永久关停盗版素材数据库;
  • 留存完整数据获取凭证;
  • 接受第三方溯源审计,确保数据合规体系真实有效。

Anthropic 的整改绝非个例,而是整个 AI 行业数据合规系统性危机的缩影。最新全球版权诉讼汇总数据显示,截至 2026 年 5 月,全球在审 AI 版权相关诉讼共 112 起,其中近八成集中在美国本土。与此同时,谷歌被阿歇特、圣智、爱思唯尔等三大出版集团联合作家在纽约联邦法院起诉,指控其未经许可抓取数百万册期刊和图书并删除版权元数据;OpenAI 与《纽约时报》及美国作家协会的诉讼谈判持续两年多仍未达成共识;Meta 的 Llama 系列同样深陷版权争议。

矛盾尖锐的根源在于:大模型迭代高度依赖海量文本,逐本签约将令研发成本呈指数级暴涨;而版权方也缺乏面向 AI 的统一授权窗口,普通作家更无与科技巨头平等谈判的筹码。IFRRO 调查显示,近八成作家和机构对 AI 未经许可的抓取行为表示担忧,超过七成认为矛盾根源在于 AI 公司版权意识缺失。

国内大模型如何走出「先上车后补票」困局

海外天价罚单同时为国内行业敲响警钟。中国《生成式人工智能服务管理暂行办法》第七条明确要求服务商使用合法来源的训练数据并留存完整溯源台账,但规定与现实仍有差距。中国信通院白皮书显示,头部大厂 92% 已搭建合规骨架,中小公司合规率不到 20%;2026 年国内 AI 版权案件暴涨 216%,其中 41% 的纠纷与本次 Anthropic 案件性质类似。

监管与司法层面正在同步收紧。今年 6 月,千余名网文作者签署《网络文学反抄袭倡议书》,直指 AI 洗稿与恶意搬运;国家版权局等四部门联合启动「剑网 2026」专项行动,将 AI 版权整治列为重点;上海市高级人民法院 5 月发布全国首例 AI 洗稿刑事案,明确「技术中立不阻却刑事责任」的司法导向。

合规市场的规模正在快速扩张。信通院数据显示,2025 年国内合规中文语料市场规模已冲至 32.6 亿元,同比增长超 40%。Omdia 数据显示,海外头部大模型合规数据授权成本已占总研发投入的 35%,预计 2026 年末将升至 45%,意味着未来 AI 订阅费中近一半将为合法数据买单。

2026 年 5 月,中国大百科全书出版社联合人民出版社、人民文学出版社、中信出版集团等首批 22 家权威单位签署《人工智能高质量语料库建设公约》,确立「先授权,后使用」的行业底线。未来,创作者有望通过集体管理组织统一向 AI 公司发放年度许可,并按使用频次分账,从根本上重塑 AI 创作的健康生态。

信源