桃子桃子快讯
返回首页
模型发布

Claude Opus 5 登场,Claude Code 之父揭秘 80% 系统提示词被删真相

Anthropic 发布 Claude Opus 5,Claude Code 之父 Boris Cherny 在 YC…

2026.07.29 · 周三4 分钟阅读

Anthropic 近日正式发布 Claude Opus 5,并在最新一期 Y Combinator 访谈中,由 Claude Code 之父 Boris Cherny 首度系统披露了这款新模型的能力亮点,以及 Claude Code 作为编排框架(Harness)的迭代方法论。访谈中提到,Opus 5 在 ARC-AGI 3 评测中取得约 30% 的得分,远超此前个位数到十几个百分点的水平,并在长时任务执行、提示注入防御等维度取得显著进展。

新模型的核心能力跃迁

Boris Cherny 在访谈中强调,Opus 5 最突出的能力是「能够持续运行非常长的时间」。当与 Auto Mode(自动模式)结合时,模型可以连续执行任务数天、数周乃至数月而不会中断,用户无需额外设置目标命令或搭建脚手架,模型自身就能识别并坚持完成目标。

另一项被重点提及的能力是抗提示注入(prompt injection)攻击。Anthropic 介绍其采用了三层防御机制:

  • 基于三年对齐研究训练的模型本身具备拒绝恶意指令的能力;
  • 基于可解释性研究成果的提示注入分类器,能够实时监测模型内部神经元激活状态,识别异常指令;
  • Auto Mode 层面的辅助分类器。

Boris 明确表示,凭借这三层机制叠加,团队已经无法再复现针对 Opus 5 的提示注入攻击。

系统提示词砍掉 80% 的背后

随 Opus 5 一同发布的还有 Claude Code 的一次大规模精简——其系统提示词被删除超过 80%。Boris 解释,这并非激进的产品策略,而是每逢新模型发布都会进行的「消融实验」:先删除全部提示词,再逐行加回,观察每一行指令是否真的带来收益。

访谈中透露了几个关键细节:

  • 新模型自身已经足够智能,过去大量提示词本质上是在「纠正模型本应知道的行为」;
  • Anthropic 内部保留了 --system-prompt 参数供用户自定义实验;
  • 通过环境变量 CLAUDE_CODE_SIMPLE=1 可启用一种「极简模式」,完全去掉系统提示词和工具提示词;
  • 消融实验发现,去掉提示词后模型表现反而「稍微更聪明一些」。

如今 Claude Code 代码库中残留的代码,绝大部分都与安全、权限、静态分析以及 UI 相关,其余逻辑均已被精简掉。Boris 建议所有 AI 产品构建者都应养成「敢于按下删除键」的习惯,每隔一段时间就主动删掉自定义指令、技能与钩子,观察模型在新一代下的真实表现。

产品构建理念:「解除 Claude 的束缚」

针对如何在 Claude 之上打造最佳 Agent 产品,Boris 提出了「解除 Claude 的束缚」这一观点。其核心概念来自研究领域的两个术语:

  • 「产品过剩空间」:当前模型已经具备大量尚未被外界发现和释放的能力;
  • 「束缚」:产品在无意中阻碍了模型发挥这些能力;
  • 「产品冗余」:未能激发模型的正确行为。

Boris 强调,Claude Code 的初代版本本身就是「束缚」与「冗余」的典型案例,而迭代的核心方法正是基于模型的有机特性,采用科学思维不断尝试、观察、再迭代。

评测体系的稳定与迭代

谈及什么应该保持稳定,Boris 表示评测(Evals)是相对长寿的资产,会不断追加新内容,但其生命周期通常也仅覆盖一到三代模型。由于当前模型能力呈指数级增长,旧评测很容易被「打满」,团队需要不断设计新的评估维度。关键仍是回到实证:使用产品、观察模型在哪些地方遇到困难,再据此构建真正需要的评测集合。

此次访谈不仅披露了 Claude Opus 5 的关键技术数据,更系统展示了 Anthropic 如何以「模型为中心」重新定义 Agent 产品的构建范式,对当前 AI 编程及 Agent 开发者具有较强的参考价值。

信源