桃子桃子快讯
返回首页
行业动态

AI 价格战白热化:中间市场成主战场

AI 推理价格持续下行,竞争最激烈的并非前沿模型,而是中间层;开源模型以约 86% 的折扣抢占大部分 token 流量。

2026.09.24 · 周四3 分钟阅读

AI 推理价格正在以前所未有的速度下行,但价格战的主战场并非「最聪明的模型」,而是企业日常真正在用的那一片「中间地带」。Theory Ventures 合伙人近日撰文指出,AI 行业最重要的市场是中间层,前沿模型的商业表现反而远低于预期。

价格连续下台阶

文章梳理了近几个月的关键降价节点:

  • 6 月,Anthropic 推出新一代前沿模型,将价格定在每百万 token 10 美元 / 50 美元(输入 / 输出,下同)。
  • 7 月,OpenAI 推出 GPT-5.6 Sol 以 5 美元 / 30 美元接招,在相近能力下把单任务成本砍到约三分之一。
  • 长期稳定的 Opus 系列价格在五次发布中始终维持 5 美元 / 25 美元,直到最近一次才首次下调。
  • 低端线 Luna 先降 80%,又在最新一轮再砍 50%。

降价节奏显示,主流厂商已经不再把「能力最强」等同于「卖得最多」,而是用更低价格争夺企业日常负载。

开源模型拿走大部分 token

闭源之间的价格战只是故事的一半。文章援引网关数据指出:

  • 在公开数据的主流 AI 网关上,开源模型已承担了大部分 token 流量。
  • 开源模型相对闭源模型的加权混合价差高达 86%。

更值得关注的是大客户正在用「开源底座 + 微调」的方式进一步压成本:

  • Cursor 的 Composer 2 基于开源模型 Kimi K2.5 微调,整体成本比此前自研模型降低 86%。
  • 法律科技公司 Harvey 在 Sonnet 5 基础上微调,单条任务成本下降 55%,效果还优于某前沿模型。

这说明对很多企业来说,「够用 + 便宜」比「最强」更值得买单。

前沿模型没那么赚钱

如果只看「谁更聪明」,结论可能会误导判断。文章给出了一组出人意料的数据:

  • Anthropic 最新、能力也最强的 Fable 5.1 发布后 12 天内,仅占网关支出的 3.7%。
  • 它的前代产品在 7 月恢复访问时达到 13.2% 的高点,但随着 Opus 5 以半价上线,一个月后份额滑落到 4.9%。
  • 在大型企业账户中,前沿模型的 token 消耗占比从 8 月初的 53% 下降到 9 月的 45%。

也就是说,AI 需求不是「少数高净值客户撑起一座金字塔」,而是一条中间厚、两端薄的钟形分布。企业真正愿意长期付费的,是「智能足够 + 价格合理」的那一档。

行业经济学将被重新定义

文章最后抛出一个判断:当「每美元智能」持续爆炸式增长,token 的消费分布可能进一步向「商品化」一端漂移。换言之,模型能力之间的差距会被价格差吃掉,中间层既是企业最大的开支,也会成为竞争最惨烈的红海。最终决定 AI 市场商业格局的,不是前沿模型的榜单分数,而是这一层中间市场的定价权。

信源