桃子桃子快讯
返回首页
行业动态

美国企业转向「Token 经济学」:省钱成新信仰

WSJ 报道揭示美国企业界集体削减大模型调用开销,Cursor、Zoom 等公司用混合模型策略压低成本,中国模型借机渗透…

2026.07.28 · 周二4 分钟阅读

据《华尔街日报》2026 年 7 月 24 日报道,美国企业界正在集体停止在大模型调用上无节制烧钱。过去两年以「Token 最大化」为荣的叙事被彻底翻转——省钱成了新信仰,节俭成了新美德。这场被 Cursor 首席技术官 Mike Saeks 戏称为「开着兰博基尼去杂货店买牛奶」的转向,正以惊人的速度蔓延,并被多家 AI 行业高管视为对过去两年 AI 泡沫叙事的清算。

从炫耀性消费到算计性生存

短短数月间,企业的 AI 消费心态发生逆转。AI 客服平台 Pylon 的 CEO Marty Kausas 直言:「我看到的客户忠诚度是零。现在真的像一场血洗。」Pylon 自身也是受益者——今年到目前为止,它从一家 AI 供应商免费获得了约 160 万美元的 Token 额度,从另一家拿了 6.5 万,再一家拿了 1 万。Kausas 总结:AI 公司正在疯狂塞优惠,只求客户别走。

这场转向的核心驱动力是模型供给过剩。Mike Saeks 的观察一针见血:「过去,最适合某项任务的模型每隔几个月才换一次。现在,感觉每周都换好几次。」Cursor 曾做过一个对照实验:从头构建一个网页浏览器,全程用 GPT-5.5 完成,花费略高于 1 万美元;改用 Cursor 自家的 Composer 模型搭配 Anthropic 的 Opus 4.8,花费 1,339 美元——相差一个数量级。这意味着前沿模型与普通模型之间的实际可用差距,正以周为单位收窄。

中国模型的「侧翼迂回」

这场硅谷省钱潮无意中验证了一个底层判断:模型的未来是商品。中国企业恰恰是商品化模型最激进的供给方——DeepSeek、月之暗面的 Kimi、智谱的 GLM、MiniMax 等名字正快速出现在美国企业的采购清单上。

  • AI 数据分析平台 Hex 的 CEO Barry McCardel 透露,过去两周内约 50% 的客户已在工作流中接入月之暗面的 Kimi 模型。
  • 法律 AI 初创公司 Harvey 用中国 GLM-5.2 处理日常任务,并配备自动判断工具:任务过难时,自动调用 Anthropic 的 Fable 5 接管。

Gabe Pereyra 总结道:「我们和所有模型都合作。」企业选择供应商的逻辑已从「婚姻式绑定」变成「约会式切换」——用最贵的做规划,用便宜的做执行,用开源的做定制,用中国模型填缝。

双叙事裂痕与政策反差

美国 AI 行业过去两年构建了双重叙事:一是 OpenAI 与 Anthropic 代表的「圣杯叙事」——更贵的研究、更大的模型、更接近 AGI 的每一次呼吸都值得不计代价投入;二是企业客户的 FOMO 叙事——害怕错过革命、疯狂采购最高端服务。两个叙事共同支撑了 AI 公司飞涨的估值与营收曲线。如今两者同时出现裂痕。

最具讽刺意味的是,这场运动恰逢美国政府酝酿限制中国 AI 模型之际。OpenAI 与 Anthropic 高管公开指责中国创业公司抄袭其技术,特朗普政府内部甚至传出全面封禁中国模型的呼声。但企业的脚比政策的嘴诚实——微软已在考虑将 DeepSeek 等中国模型整合到自家平台;英伟达、微软、Palantir 等科技公司联名签署公开信,敦促政策制定者对潜在限制保持克制。当 API 账单可以省下一个数量级时,意识形态顾虑往往被暂时搁置。

「三个臭皮匠」的混合策略

Zoom 的做法最具象征意义。这家公司三年前开始使用 Meta 的开源模型 Llama 并进行精调,如今同时使用 Anthropic、OpenAI 和多个开源模型。Zoom 首席技术官黄学东援引「三个臭皮匠,顶个诸葛亮」的古语,认为模型混用才是企业降本的「秘密酱汁」。

这与 OpenAI 与 Anthropic 的线性叙事形成鲜明对比:后者认为通往智能的路是等级森严的,最聪明的人造出最聪明的模型;前者则证明可以拼装出一个聪明的系统。一个追求深度,一个追求广度;一个追求智能上限的苦行,一个追求成本下限的精算。Cursor 的实验也证实,最复杂任务仍需最强大模型来规划、审核、把关,但「无可替代的顶层」与「可被拼装的底层」是两种完全不同的生意——前者是圣杯,后者是管道。圣杯依然闪耀,但人们开始计算去往杂货店的油费了。

信源