桃子桃子快讯
返回首页
产品功能

Claude Code 之父:模型迭代太快,harness 保质期只有半年

Anthropic Claude Code 负责人 Boris Cherny 呼吁每六个月重写 harness,主张删掉…

2026.07.30 · 周四4 分钟阅读

Anthropic Claude Code 负责人 Boris Cherny 在 YC 7 月 28 日发布的访谈视频《Boris Cherny: We Cut 80% of Claude Code's Prompt》中,分享了一套颇具颠覆性的产品迭代方法论:每六个月,把 Claude.md、skills、hooks 全部删掉,从零开始重建。他的核心观点是,模型迭代速度太快,任何写死的 harness 都会迅速过时,工程师与其花时间猜模型需要什么,不如一行行删、一行行加,看模型到底在哪里卡住。

80% 提示词已被删除

7 月 24 日,Anthropic 发布了关于 Claude 上下文工程的最新规则。针对 Opus 5 等新模型,Claude Code 的 system prompt 被大幅精简,删除了超过 80% 的原有指令。Boris 在访谈中透露,今天 Claude Code harness 里的代码,几乎只剩下安全、权限和静态分析的部分。

他认为这种精简背后的逻辑是经验主义的:不加预判地尝试,查看结果,迭代,重复。模型每代行为都略有不同,工程师必须把它当成一种「活的生物」来对待。Boris 同时指出,Eval 也未必能稳定使用——模型进化太快,一套评测很快就会被刷到满分,因此需要持续观察模型在哪里挣扎,再设计新的评测。

「悬余」与「解缚」

访谈中 Boris 提出了两个关键概念。

  • Product Overhang(产品悬余):大模型以不连续的跳跃式速度演进,产品集成却以连续增量的节奏推进。这意味着模型能力总会超出现有产品所能释放的边界。Boris 举例说,2024 年底 Sonnet 3.5 推出时,模型已经能一次性写整个文件的代码,但当时的 Copilot、Cursor 早期版本还在做代码补全。
  • Unhobbling(解缚):拿掉限制,释放模型已有但未被调用的能力。Boris 提到,Anthropic 内部有人尝试给 Opus 5 接入 OpenCV,结果模型自己画出了人物肖像和动物风景,而团队从未专门训练它画画。这种现象被称为「模型激发」(model elicitation)。

三条「解缚」方法

  • 给模型比想象中更难的任务:描述清楚目标、边界和退出条件,然后放手。Boris 自己举了一个例子:他让 Claude 把 Electron 应用重写成 Swift,让它在 Mac 虚拟机里运行原版、截图、逐像素对比 Swift 版本,没做完就不停。这条 prompt 已经跑了 14 到 15 天,Claude 还在建 Slack 频道,每隔几分钟发一张进度截图。
  • 多做实验:允许模型做没有明确商业目的但有趣的尝试。
  • 让模型自我验证:Boris 认为这是当下大家做得最不尽如人意的一环。如果模型不能在过程中验证自己的工作,它就无法长时间独立运行。

给开发者与编程学习者的建议

在访谈末尾,Boris 给出了几点实用建议。

  • 别去刷 LinkedIn 和 Twitter 上那些 AI「奇技淫巧」,那些东西根本不存在。
  • 用经验主义方式对待模型:忘掉旧模型的经验,放下「以前不行」的先验,直接观察模型在哪里卡壳,再针对性调整。
  • 把模型当同事相处,不过度指定,不试图让它完全按你的方式工作,因为「模型不是那样工作的」。

对于还在学习编程的人,Boris 建议不要只学纯计算机科学理论,要学会如何应用——把编程和设计感、商业感、数据科学、用户沟通结合起来,才有真正的价值。「先做自己想要的东西,再升级去做别人想要的东西。」

原文来自微信公众号「量子位」(ID: QbitAI),经 36 氪授权发布。

信源