Vercel 数据显示开源模型已反超闭源,DeepSeek-V4-Flash 居首
Vercel CEO 公开发布数据:8 月 22 日其 AI Gateway 开源模型占比升至 62%,闭源跌至 38%…
美国云开发平台 Vercel 的 CEO Guillermo Rauch 近日在社交平台公开了一组数据:在 Vercel AI Gateway 上,开源权重模型按 token 占比首次反超闭源模型,DeepSeek-V4-Flash 登顶 token 量榜首。这条来自一家美国公司自家平台的数据,被视作开源阵营在开发者市场加速渗透的标志性信号。
数据:两个月内开源占比从 28% 升至 62%
Rauch 公布的关键节点如下:
- 6 月 24 日左右:开源权重 28.4%,闭源 71.6%。
- 8 月 18 日:开源权重升至 54%,闭源降至 46%。
- 8 月 22 日:开源权重进一步升至 62%,闭源跌至 38%,为该平台历史新高。
Vercel AI Gateway 是面向开发者的模型路由服务,可将请求分发到数十家模型厂商。其 token 结构偏向构建代码与智能体(agent)类应用,天然有利于低价、高吞吐模型放量。
DeepSeek-V4-Flash 为何登顶
DeepSeek-V4-Flash 是中国实验室 DeepSeek V4 系列的轻量版本,今年 4 月预览、7 月底更新后正式放量。关键规格:
- 架构:混合专家(MoE),总参数 2840 亿,单 token 激活约 130 亿。
- 上下文窗口:100 万 token。
- 权重许可:以 MIT 协议发布在 Hugging Face,可自由下载、自托管。
- 价格(8 月中旬前):输入 0.14 美元 / 百万 token,输出 0.28 美元 / 百万 token。
在 token 量榜单中,DeepSeek-V4-Flash 排名第一,其后主要由中国模型占据,包括 StepFun(阶跃星辰)的 Step 3.7 Flash、智谱的 GLM-5.2,以及另一款 DeepSeek 版本。前五名中唯一非中国厂商的,是 OpenAI 的 GPT-5.6 Luna。
价格已上调:8 月 16 日起改为峰谷定价
值得关注的转折发生在 8 月 16 日:DeepSeek 将 V4-Flash 的统一费率改为峰谷分时定价:
- 高峰时段:输入 0.44 美元 / 百万 token,输出 1.32 美元 / 百万 token。
- 非高峰时段:输入 0.22 美元 / 百万 token,输出 0.66 美元 / 百万 token。
新价格仍低于多数美国前沿模型,但已不再是最初吸引开发者迁移的"地板价"。调价恰逢使用量曲线陡峭上行,时机耐人寻味。
一个平台的数据够说明问题吗
需要明确的是,Vercel AI Gateway 只是众多模型分发渠道之一,且高度偏向代码与 agent 场景;按 token 量计价天然对低价模型有利。若改用收入、付费用户数或带合规要求的企业合同来衡量,闭源阵营的相对位置会显著不同。
但从 28% 到 62% 的两个月跃迁幅度过大,难以用噪声或短期促销解释:成本优势来自 MoE 架构本身而非临时补贴,再叠加 MIT 协议下的自托管自由度,开发者选择它所形成的复合优势,并不会因为一次调价而消失。
对闭源阵营意味着什么
过去三年美国实验室的核心假设是:能力即护城河,把最强模型锁在 API 后、收取前沿价位,让其他玩家在边缘市场缠斗。这一假设成立的前提,是开发者愿意为"前沿"二字付费。Vercel 的数据暗示,多数开发者购买的其实是"够用且便宜"的能力。
闭源阵营的领先地位并未丢失——前沿模型仍享有溢价,受监管客户仍愿为合规与支持付费。但本周在一家美国平台上被公开动摇的,是那个根深蒂固的判断:"开源 = 次优"。当默认选项被改写,习惯也随之改变——软件开发的地面层,正在被低价、开源、可自托管的中国模型悄然接管。
