桃子桃子快讯
返回首页
行业动态

Codex 与 Claude Code 负责人公开互怼,背后是模型与 Harness 的竞争之争

OpenAI Codex 与 Anthropic Claude Code 负责人在 X 上隔空交锋,起因是开发者用 Cl…

2026.08.10 · 周一6 分钟阅读

一场由开发者账号封禁引发的争议,最终演变为 OpenAI Codex 负责人 Thibault 「Tibo」 Sottiaux 与 Anthropic Claude Code 负责人 Boris Cherny 在 X 上的公开交锋。这场口水仗表面上是两位产品负责人的互相「整活」,背后却触及了 Coding Agent 领域一个越来越核心的问题:当模型可以被替换时,竞争的主战场到底是模型,还是承载它的 Harness。

事件起因:用 Claude Code 跑 GPT 模型

事情最早发生在 7 月 12 日。开发者 Theo 在 X 上提出一个观察:同一个 GPT-5.6 Sol,放到 Claude Code 的运行环境中,部分任务上的表现甚至优于放在 Codex 里。换言之,模型没变,变化的是外面的 Agent Harness。Tibo 随即追问配置细节,并在次日公开分享了实现方法:保留官方 Claude Code CLI 不做修改,在本机启动 CLIProxyAPI,把推理请求转发给其他模型提供商。Alex Getman 后来将这套方案整理成开源项目 Claudex,Claude Code 的界面、工具、Skills、权限体系保持不变,只有最底层的推理模型被替换成 GPT-5.6 Sol、Gemini、xAI、Kimi 等。Tibo 当时还留下一句话:「如果这个办法被封,我欠大家一次 reset。」

封号风波与双方回应

8 月,Alex 几乎原样复刻了 Tibo 的方案,在 127.0.0.1 上用 CLIProxyAPI 将请求转给 GPT-5.6 Sol。测试没多久,他的 Anthropic 账户被暂停,系统仅给出「suspicious signals」一条理由。Alex 公开申诉,并 @ 了相关方,同时在仓库加入 Warning,暂不建议其他用户复制该配置,但明确表示目前并不确定封号与代理配置之间存在直接因果。

Tibo 在评论区隔空回应,称自己「又不在 Anthropic 工作」,如果仅仅因为「在他们的 Harness 里用了其他模型」就被封,确实奇怪。Claude Code 负责人 Boris Cherny 随即下场,但他的第一句话不是解释封号,而是公开邀请 Tibo 来 Anthropic 工作。面对挖角,Tibo 拒绝,理由是「太喜欢现在的团队」,并期待接下来几周要发布的东西。

随后 Boris 才回到正题:Anthropic 不会因为用户在 Harness 中使用其他模型就封号,初步判断是另一套账户分类器被误触发,团队正在调查。Claude Code Harness 搭配其他模型本身是支持的,可通过 LiteLLM 等代理方式实现。Alex 的账户随后被恢复,Boris 确认「Unblocked」。

「Reset」承诺与社群反应

虽然 Anthropic 否认有意针对其他模型,但用户确实被封了一次。Tibo 因此兑现一个月前的承诺,为所有 ChatGPT Work 和 Codex 付费用户重置了一次使用额度。Sam Altman 也下场,只留下一句:「lol, one of my favorite things about OpenAI is Tibo.」

不过社群很快发现,多数用户的每周额度在前一天刚正常刷新过,因此这次 reset 被吐槽更像是「performative」——表演性质大于实际意义。Tibo 也不回避,回应周一再来一次「表演性质」的 reset。有用户建议 OpenAI 建立可储存、按需使用的额度恢复机制,而不是临时制造惊喜;也有用户开始取消周末安排,准备在预期中的 reset 到来前烧光额度。

模型与 Harness 正在解耦

抛开口水仗,这场交锋暴露了 Coding Agent 竞争逻辑可能正在发生变化。

  • 模型层:决定推理、代码理解与生成能力。
  • Harness 层:决定模型能看到什么上下文、可调用哪些工具、何时执行命令、怎样压缩上下文、如何维护长任务,以及人与模型、开发环境之间的完整循环。

OpenAI 官方已把 Codex 的 Harness 单独描述为连接模型、工具和用户环境的编排层;Anthropic 的官方文档则为 Claude Code 定义了完整的 LLM Gateway Protocol,并提供接入第三方 Gateway 的配置说明。这意味着开发者开始把「模型 + Harness」当作两层独立选择,「一个模型必须绑定一个官方客户端」的默认组合正在松动。Theo 最初那句「同一个 GPT-5.6 Sol,在 Claude Code 里可能表现更好」之所以敏感,正是因为它把竞争从「谁家模型更强」推向了「谁更擅长把模型能力真正释放出来」。对 OpenAI 而言,允许 GPT-5.6 Sol 运行在 Claude Code 里,削弱了客户端锁定,却扩大了模型分发范围;对 Anthropic 而言,如果 Claude Code 足够好,让用户即便不用 Claude 模型也愿意继续用 Claude Code,那么 Claude Code 本身就有机会成为独立于底层模型的入口层。这或许才是这场公开互怼背后,真正值得关注的趋势。

信源