出版方与 Reddit 重新审视与 Google 的 AI 数据交易
Google AI 摘要蚕食网站流量,Reddit 与出版方正考虑退出或中断与 Google 的数据合作。
The Verge 最新一期「Vergecast」节目聚焦「Google Zero」现象:随着 Google 在搜索结果中大规模引入 AI 摘要,传统的「Google 索引网页—为网站导流」默契正在瓦解。Reddit 以及一批出版方正尝试重新掌握主动权,部分平台甚至考虑彻底阻止 Google 抓取其内容。
旧秩序的瓦解
长期以来,Google 与互联网内容方之间存在一种隐性交易:Google 抓取并索引全网页面,作为回报,它通过搜索结果向网站输送海量流量。这套机制并不完美,Google 自身从中获益更多,但确实在相当长时间里支撑了整个开放网络的内容生态。当 AI 概览等新功能在搜索结果中直接给出答案、并越来越多地占据用户视线时,原本流向第三方网站的点击开始被截留,「Google Zero」一词开始在出版圈流传,意指来自 Google 的自然流量趋近于零的处境。
Reddit 想要退出 AI 训练协议
节目披露的最新动向之一,是 Reddit 对其与 Google 之间 AI 训练数据协议的态度发生转变。Reddit 长期是英文互联网最大的用户生成内容来源之一,其数据对训练对话式 AI 十分关键。在 AI 摘要削弱外部导流的背景下,Reddit 被报道正在考虑重新评估乃至退出这笔交易,以掌握自身语料的使用方式与议价空间。
出版方的反击选项
与此同时,部分出版方正考虑更激进的应对方式——直接阻止 Google 爬取其站点内容。在过去,屏蔽 Google 几乎等于「自断流量」,代价过高;但当 AI 摘要让 Google 流量的回报率持续下降、而抓取数据却被用于训练竞品模型时,天平开始倾斜。出版方的逻辑正从「如何从 Google 拿更多流量」,转向「是否值得继续免费供 Google 训练」这一根本问题。
播客讨论的更大议题
这期 Vergecast 由 David 与 Nilay 共同主持,话题从具体案例延伸到 AI 搜索时代的内容分发与数据权属之争。对于依赖搜索流量变现的中小网站,以及掌握语料的平台而言,这并不意味着简单回到旧秩序,而是需要在 AI 时代重新定义「被索引」与「被训练」分别值多少钱。
