谷歌败诉后仍坚持阻击 AI 爬取,Reddit 意外站队
谷歌在诉讼中败诉后仍将继续阻止 AI 机器人爬取搜索结果,Reddit 罕见地加入谷歌一方。
上周在一场备受关注的诉讼中遭遇重大挫折后,谷歌已确认不会放弃阻止 AI 机器人爬取其搜索结果的努力。出人意料的是,社交平台 Reddit 也以某种方式加入了这场冲突。
诉讼背景:谷歌起诉 SerpApi
去年 12 月,谷歌援引《数字千年版权法》(DMCA),对网页爬取服务商 SerpApi 提起诉讼。谷歌指控 SerpApi 绕过了其部署的反爬取技术,并通过未授权的「Google Search API」软件服务,将从谷歌搜索结果中抓取的内容对外售卖。SerpApi 的商业模式正是向第三方提供搜索引擎结果数据,而 AI 训练数据需求是其重要的下游应用场景。
谷歌的核心主张
谷歌方面表示,其反爬取技术的目的在于保护搜索结果中受版权保护的内容。SerpApi 的规避行为据称威胁到谷歌与版权方的合作关系——部分权利方将其内容授权给谷歌,用于在搜索结果中展示知名人物或实体的所谓「知识面板」(knowledge panels)。谷歌认为,SerpApi 的行为实质上破坏了其与这些权利方之间的授权协议。
法庭挫败与继续上诉
尽管在上周的法庭较量中遭遇重大不利裁决,谷歌已明确表态将持续这场法律战。值得注意的是,Reddit 也被提及加入这场冲突,其具体角色和动机尚待进一步披露。这一联盟显得有些反常,因为 Reddit 自身也是大量公开内容的提供者,长期以来与各类 AI 爬取者关系微妙。
对 AI 数据生态的潜在影响
此案最终走向将对 AI 训练数据的获取方式产生深远影响。若谷歌在后续程序中胜诉,可能为搜索引擎运营商设立有约束力的先例,限制第三方大规模抓取搜索内容用于 AI 模型训练。反之,若 SerpApi 一方最终胜诉,则可能进一步鼓励 AI 公司通过第三方聚合数据渠道绕过内容方的技术保护。这场诉讼也是 AI 行业与内容版权方之间持续博弈的一个缩影,其后续进展值得持续关注。
