亚马逊180万美元Claude账单背后:大厂AI成本集体失控
亚马逊用Claude填充作者信息花费180万美元,超预算860%。多家大厂正为AI Agent失控买单,纷纷收紧预算。
最近,亚马逊在内部使用 Anthropic 的 Claude Sonnet 时,遭遇了一场昂贵的「翻车」:原本只是想用它给网站填充作者信息,最终花费约 180 万美元,超出预算 860%,历时 5 个月才被发现,且最终未能成功部署。这一案例折射出 AI Agent 在大型企业落地过程中的真实困境,也预示着硅谷正从「算力狂欢」转向「预算紧箍」。
亚马逊的 180 万美元教训
据亚马逊员工透露,公司尝试用 Claude Sonnet 处理一个看似简单的「网站作者信息填充」任务。然而由于 Agent 在缺乏预警机制的情况下反复重试,最终账单高达 180 万美元,超出预算 860%,且耗时 5 个月才被发现。Claude Sonnet 当前公开定价约为每百万输入 token 3 美元、每百万输出 token 15 美元,按此折算,180 万美元对应的 token 量最高可达约 6000 亿——相当于 GPT-3 整个训练语料的两倍。
这类 bug 在亚马逊内部并非孤例,且往往潜伏数月才会被发现。讽刺的是,相较于传统系统里无足轻重的小问题,AI 出错带来的成本规模往往难以想象。
押注 AI 与大规模裁员并行
成本超支并未阻挡亚马逊的自动化步伐。CEO Andy Jassy 宣布,亚马逊 2026 年资本开支预计约 2200 亿美元,绝大部分投向 AWS、自研 AI 芯片与电力基础设施,较 2025 年增长近六成,是全球超大市值公司中最高的单年度资本开支。
最新季度财报显示,AWS 净销售额达 422 亿美元,同比增长 37%;在亚马逊 275 亿美元总营业利润中,AWS 贡献了约 60%,而其收入仅占公司总收入的 21%。与此同时,亚马逊自 2025 年 10 月以来已进行两轮大规模裁员,累计削减约 3 万岗位。
Jassy 在内部备忘录中展望:「我们如今有 1000 多种生成式 AI 服务,但从规模看还只是冰山一角。未来会有数十亿个 Agent 在亚马逊运转。」亚马逊机器人部门的目标是在 2033 年前后实现约 75% 的仓储运营自动化,预计到 2027 年将少雇约 16 万人,到 2033 年少雇超 60 万人。2024 年诺贝尔经济学奖得主、麻省理工学院教授 Daron Acemoglu 警告,若这一蓝图落地,亚马逊将从「净岗位创造者」变成「净岗位毁灭者」。
Token 失控并非孤例,大厂纷纷「上锁」
亚马逊的教训只是冰山一角。年初以来,多家科技巨头的 AI 用量相继失控,员工内部甚至自发搭建 token 消耗排行榜,「烧币传奇」「缓存法王」等称号一度流行。
- Meta:一名员工搭建名为「Claudeonomics」的非官方排行榜,聚合超 8.5 万名员工的 AI 用量数据,30 天内 token 总量攀升至 73.7 万亿,按公开定价折算相当于每月约 2.21 亿美元。Meta 随后向约 6000 名员工发备忘录,对 token 用量设限并搭建中央监控平台「AI Gateway」。
- Uber:2026 年前四个月便烧光全年的 AI 编程预算,随后将每名员工、每个工具的月支出上限设为 1500 美元。其 COO 坦言,token 支出与可衡量产出之间的联系「尚未成型」。
- OpenAI:Sam Altman 透露,内部用量最高的个人用户每月消耗约 1000 亿 token,有员工曾在单周内烧掉约 2100 亿 token。他表示,AI 成本问题在年初还无人问津,如今已成为大问题。
一项行业调查显示,仅有 26% 的企业对自身 AI 成本具备全面可见性。换言之,大多数公司在开始节流之前,甚至不清楚此前究竟花了多少钱。
自动化失灵的历史警示
历史早已给出过类似的教训。2012 年,美国股票做市商骑士资本(Knight Capital Group)在一次系统部署中无意激活了一段旧代码。45 分钟内,系统在 154 只股票上执行了超 400 万笔毫无经济逻辑的交易,累计买入约 70 亿美元公司无意持有的头寸。最终亏损约 4.4 亿美元,相当于公司全年利润的三倍;消息公布后两个交易日内,股价蒸发 75%,公司最终被竞争对手收购。
自动化承诺更快的速度、更低的价格、更少的人为差错;但当系统出错时,损失也会以同样的速度、规模与效率被放大。对亚马逊而言,这笔 AI 学费恐怕不会是最后一笔,而整个行业也正在重新审视「以 Token 论英雄」式的粗放扩张。
