美国法院厘清 AI 训练版权边界
Anthropic 案认定模型训练本身合法,但盗版取数受罚,AI 版权边界仍待更多判例厘清。
随着 ChatGPT、Gemini、Claude 等模型广泛使用出版作品训练,AI 公司与作者、出版商之间的版权冲突持续升级。近期涉及 Anthropic 的裁决显示,使用版权作品训练模型,与通过盗版来源获取训练数据,可能产生完全不同的法律评价。
裁决区分训练与盗版取数
在 Anthropic 与作家群体的案件中,法官 William Alsup 命令 Anthropic 向相关作家支付 15 亿美元。裁决同时认定,使用版权作品训练 AI 模型本身并不违法,受到惩罚的重点是 Anthropic 从非法在线影子图书馆盗版获取书籍。
知识产权律师 Cathy Gellis 认为,这一结果总体有利于 AI 公司。她指出,版权制度关注的是是否复制作品,而阅读、学习和使用作品并不等同于复制。法官也将大模型吸收海量文本比作作家研读既有文学作品。
合理使用取决于竞争关系
美国法院通常通过合理使用原则判断训练行为是否合法,考察因素主要包括:
- 使用作品的目的和性质
- 使用作品的数量与比例
- 训练行为对原作市场的影响
在 Thomson Reuters 诉 Ross Intelligence 案中,Ross Intelligence 使用受版权保护的内容开发直接竞争的法律研究平台。法院认为,这一用途没有增加足够不同的目的或性质,因此不构成合理使用。知识产权律师 Jason Henderson 表示,当 AI 产品直接与权利人的现有业务竞争时,法院通常会更谨慎。
这意味着,模型训练是否合法不能只看出处,还需分析训练目的、模型用途以及其对原作市场的潜在替代程度。
AI 生成内容如何确权
训练阶段的版权争议之外,AI 生成内容能否获得版权保护也尚无统一答案。在 Thaler v. Perlmutter 案中,法院裁定,完全由 AI 生成的作品不具有可版权性。
由此产生的问题是,如何确定一件作品是否由 AI 生成,以及人的创作贡献达到何种程度才会影响版权归属。Cathy Gellis 以文字处理软件和拼写检查为例指出,AI 正迫使法律重新审视过去长期被忽略的人类创作判断。
法律仍处于过渡期
相关版权法律框架主要形成于 1976 年,难以直接覆盖当前的大规模模型训练。不同法院对训练行为是否构成合理使用仍可能给出不同理由,而多数 AI 公司仍面临尚未解决的诉讼。
短期内,Anthropic 与 Ross Intelligence 等案件将成为重要参照,但不能替代更明确的立法或稳定判例。AI 公司需要同时关注训练数据来源、使用目的、输出市场与潜在竞争关系,版权边界则仍需后续诉讼进一步确认。
