生成式 AI 重塑图书市场:销量 19 倍背后的收入悖论
实证研究:AI 生成图书占品类大头但侵蚀营收,规模化而非高质量重塑亚马逊创作市场版权争议。
一项 2026 年 7 月发表于 arXiv 的实证研究,基于亚马逊 14,419 本自出版图书的全文本 AI 检测与销量数据,揭示了生成式 AI 在类型小说市场的真实冲击:AI 内容已形成规模效应,正在改变畅销榜格局,并为版权「合理使用」之争提供新的实证依据。
研究方法与样本规模
研究覆盖 2023 年至 2026 年间在亚马逊销售的自出版类型小说,并与逐日销量记录匹配至 2026 年 6 月。研究者采用全文本 AI 检测,以「AI 文本占比超过 25%」为阈值,识别各书的 AI 含量。需要指出的是,所有图书均未在元数据中披露是否包含 AI 生成内容,这意味着市场层面的 AI 渗透几乎完全「隐形」。
销量增长 19.2 倍,收入仅增 8.9 倍
实证结果与「AI 图书只是低质 slop,买家会无视」的常见假设并不完全一致。
- 含大量 AI 文本的图书在目录中占大头,但在整体销售份额中相对偏低;
- 即便如此,这类书已具备商业规模,并在观察期内赢得越来越大的销售份额,逐步挤占那些未检测到 AI 文本的图书所占据的畅销榜位置;
- 更关键的是「量价背离」:观察期内有销量的图书数量增长 19.2 倍,而季度营收仅增长 8.9 倍,市场新增售书的速度远快于新增收入;
- 在大多数类型小说品类中,每本有销量的图书的平均收入出现下滑。
换言之,AI 图书不一定「更好」,但它们以数量优势稀释了头部营收池。
哪些品类输得最惨
进一步拆解显示,未含 AI 文本的图书在 AI 渗透率更高的品类中跌幅最大,且在亚马逊「按页阅读」订阅服务 Kindle Unlimited 覆盖率高的品类,损失最为显著。这意味着按页付费的流量分配机制,可能进一步放大 AI 内容对原创作者收入的挤压。
语言重叠与版权含义
研究在畅销书层面发现了一个值得版权法学者警觉的现象:
- 含大量 AI 文本的畅销书相比无 AI 文本的畅销书,使用了更多与既有作品重合的「独特语言」;
- 对这些 AI 含量高的畅销书而言,语言重叠度越高,销量反而越大;
- 这一「重叠度—销量」的梯度关系,在无 AI 文本的图书中并不存在。
作者据此指出,生成式 AI 可以通过「规模」而非「质量」重塑创意市场,其发现直接关系到版权侵权「合理使用」抗辩的核心命题:在多大程度上,被告可以主张其 AI 生成内容对市场的影响尚不构成「实质性损害」。
研究状态
该论文目前标注为「Working Paper Under Review」,作者来自 Tuhin Chakrabarty 等研究者,2026 年 7 月 22 日提交,可在 arXiv 通过编号 2607.20349 获取全文。
