Claude Code 套餐补贴 13 倍,企业转向自建模型
Upbound 工程师团队按 API 挂牌价测算,Claude Code 真实 token 成本平均是其 $125 套餐…
Upbound 工程团队近期公布的一组内部数据显示,其 20 名工程师使用 Anthropic Claude Code 的真实 token 成本,按 Anthropic 官方 API 挂牌价计算,平均是其 $125/月 Premium 套餐费用的 13 倍。文章作者将这一比率称为「补贴倍数」(subsidy multiple),并指出随着 Anthropic 等厂商开始优化利润率,这种低价套餐模式难以长期维持。
数据样本与口径
Upbound 团队通过 Claude Code 本地会话日志(每条消息都会记录 token 数)统计了 6 月份的实际用量,再按 Anthropic 官网 API 价格折算:
- 用量最低的工程师不足 $10,最高的一人达到 $6,470;
- 平均约 $1,625/月,中位数约为套餐费的 7 倍;
- 用量最大的工程师相当于单座位的 52 倍;
- 总量中 90% 以上来自 Opus 系列,且以 Opus 4.8 为主。
需要说明的是,折算基于列表价,且已包含按 1/10 输入价计费的缓存读取,实际可计费成本可能略低;但作者强调,即便加上这些折扣,整体量级不会改变。Upbound 同时表示,所有原始 prompt 与代码均未上传,折算脚本在本地运行,只输出计数与金额,便于复用。
大公司的同一面墙
Upbound 称自己并非个例。Uber CTO 此前向 The Information 表示,公司约 5,000 名工程师在四个月内烧光了 2026 全年的 AI 预算,Claude Code 使用率从 32% 升至 84%,人均 $150–$250/月、重度用户 $500–$2,000/月;其本人曾在一次两小时会话中花掉 $1,200。Uber 随后将单人月度上限设为 $1,500。
Tesla 数周前也将员工上限设为 $200/周,此前已有工程师单周消耗数千美元 token。Meta、Amazon、Walmart 也被报道采取类似措施:或限制用量,或引导工程师迁移到更便宜的模型。Upbound 的 13 倍数字,是同一面墙的不同距离——只是它在限流阀装上之前就先量了出来。
从买 token 到跑模型
面对这一预期,Upbound 表示已开始尝试自托管开源权重模型,理由有两层:
- 成本侧:把开销锚定在自可控的算力上,而非随时可被调价的 token;
- 数据侧:保留提示词与上下文的自有性,不必为使用他人智能而必须交出专有知识。
来自 Vercel AI Gateway 的数据也指向同一方向:开源权重模型在该平台的流量占比从 4 月的 11% 升至 6 月的 29%,而花费占比仍不到 4%。文章引用 Satya Nadella 的判断:用别人的模型,「你为智能付了两次钱——一次用钱,一次用为了让智能真正有用而必须交出的专有知识。」Upbound 的下一步,是把这第二笔钱也省下来。
