Kimi K3 引战,OpenAI 与 Anthropic 掀起智能体额度大战
奥特曼罕见认错,Codex 四天新增 300 万活跃用户,OpenAI 与 Anthropic 在同一周围绕额度与定价正…
7 月 17 日凌晨,月之暗面正式发布开源模型 Kimi K3,被业内类比为「第二次 DeepSeek 时刻」。几乎同一时间,OpenAI 与 Anthropic 在智能体赛道正面交锋,围绕额度、定价与使用量打了一场消耗战。
奥特曼罕见认错:押注「最强 12 个月」
OpenAI CEO 奥特曼在 X 上发文,开篇便主动揽责:「过去 12 个月我们的表现并不理想,这主要是我的过错。」这种把业绩问题公开归因于个人的表态在科技公司高管中并不常见。
话锋随即一转,他表示 OpenAI 即将迎来「有史以来最出色的 12 个月」,团队正取得「让他们满意的结果」。这一表态迅速引发社区对下一代模型——尤其是 GPT-6——是否临近的猜测。但从后续信号看,他真正押注的或许不是一款新模型,而是 AI 产品形态的彻底切换:从「回答问题」变成「替你干活」。
Codex 四天新增 300 万活跃用户
与奥特曼的发声形成呼应的是 Codex 的爆发式增长。OpenAI Codex 负责人 Tibo 在 16 日披露,Codex 与 ChatGPT Work 合计活跃用户已突破 900 万:
- 2 月:不到 100 万
- 7 月 12 日:600 万
- 7 月 14 日:800 万
- 7 月 16 日:900 万
四天净增 300 万。Tibo 表示本打算更早恢复用户额度,但团队被「数以百万计的任务」绊住,正连轴转地保障系统稳定。这一幕与 5 月 Anthropic CEO 达里奥「增长太快、扛不住」的表态形成有趣对照。
同一周,两家同时送额度
在奥特曼发帖前后,OpenAI 与 Anthropic 几乎同步展开了额度争夺:
- OpenAI:临时取消 ChatGPT Plus、Pro、Business 的 5 小时使用限制,分批为约 50 万到 700 万用户重置额度。
- Anthropic:延长 Claude 付费版本的访问时长,并把 Claude Code 周额度上调 50%,两项优惠均延至 7 月 19 日。
表面上是补贴用户、争夺留存,实质上是在争夺智能体时代最珍贵的资源——长任务、高强度的真实使用数据。
CFO 推出新尺子:「每美元有用智能」
奥特曼公开认错的同一天,OpenAI CFO Sarah Friar 发表了署名文章,提出衡量 AI 价值的新指标:Useful Intelligence per Dollar(每美元买到的有用智能)。
Friar 认为,过去软件衡量的是席位与采纳率,AI 时代则要换成「干成了多少活」。她直接点破「最低 token 价格 ≠ 最低结果成本」的幻觉,给出全成本公式:
全成本 =(模型调用费用 + 计算资源 + 人工审查时间 + 重试次数 + 返工成本)÷ 成功达标任务数
按 OpenAI 给出的数据,在长周期工程任务基准 DeepSWE v1.1 上,最新旗舰模型 GPT-5.6 Sol(最高推理档)得分 72.7%,高于 Claude Fable 5 的 69.9%;同时输出 token 减少 54%,预估 API 成本降低 36.2%。
双雄之争:谁的 AI 先住进工作流
年初,Anthropic 的 Claude Code 与 Cowork 先声夺人,把智能体从程序员推向普通知识工作者。7 月 9 日,OpenAI 上线 ChatGPT Work,内置 Codex 与 GPT-5.6 Sol,几乎正面迎战 Cowork。
相较之下,OpenAI 拥有短期内难以复制的分发优势:超 9 亿周活的 ChatGPT 应用内即可直接使用智能体,而 Cowork 需要单独下载桌面端。奥特曼透露,agentic 产品使用量周环比增长 2.5 倍。
当计价单位从「席位」与「token」变成「完成的工作」,这场竞争的胜负或许不再取决于谁的模型更强,而取决于谁先把 AI 真正嵌进每一个人的日常工作流。
