桃子桃子快讯
返回首页
行业动态

Claude Code 提示词删改背后:一场价值千金的「苦涩教训」

Anthropic 削减 Claude Code 系统提示词超 80%,又在 Opus 5 中部分回填,折射出新模型时代…

2026.07.29 · 周三5 分钟阅读

围绕 Claude Code 系统提示词到底是被砍掉还是悄悄增加,社区吵了好几天。先是 Claude Code 团队成员 Thariq Shihipar 发文称,他们把系统提示词砍掉超过 80%,内部编程评测却未见明显下滑;两天后,Qoder 工程师陈成抓取实际请求后发现:大幅精简发生在 Opus 4.8 而非 Opus 5,Opus 4.7 的提示词约 15225 个字符,4.8 降至 4467 个,Opus 5 又回升到 7694 个,比 4.8 长 72%。两组数据互相对冲,外界一度怀疑是烟雾弹。然而顺着两边的资料对照,可以把这轮删改背后的工程逻辑理清楚。

删掉的 80%:旧模型时代的六条最佳实践

Anthropic 团队在翻看内部使用记录时发现,同一个请求里常常出现相互冲突的指令:系统提示词说「不要加注释」,Skills 又说「适当补充文档」,用户还临时要求「把复杂逻辑解释清楚」。旧模型本身判断力不足,必须把规则写死,否则最坏情况会乱删文件;但新模型已经能结合上下文自行权衡,旧的硬规则反而成了冲突源头。这次删除主要沿六个方向展开:

  • 让模型自己判断:不再硬性禁止注释或多段文档字符串,只保留「匹配周围代码的注释密度、命名和习惯」一条要求,模型需要根据任务自行决定表达方式。
  • 设计接口而非塞示例:新模型容易把示例当作全部答案,因此减少用例罗列,转而设计结构化接口。例如 Todo 工具只需把状态限定为 pending、in_progress、completed,且同时只能有一个任务进行,模型即可自行推断用法。
  • 按需加载而非一次性全量灌入:把审查、验证、工具说明拆成独立 Skills,工具定义通过 ToolSearch 按需加载,模型只需知道「东西在哪」,真需要时再取。
  • 一件事只在一个地方说:旧模型易忘指令,规则往往在提示词、工具描述、示例里反复出现,新模型对长上下文理解更深,重复提醒反而制造冲突,因此同一件事只交由一处负责。
  • 把长期状态交给自动记忆:项目说明、用户偏好、工作经验等交给自动记忆模块,CLAUDE.md 只保留代码库简介和真正反常识的坑。
  • 直接给简单规格:HTML 原型、测试用例、现有代码、评分标准等都可以作为输入,一张真实原型图传递的信息远多于「页面要高级、简洁、有呼吸感」一类描述。

Anthropic 删掉的并不是上下文本身,而是人类替旧模型预先做好的判断。

增加的 70%:管住新模型的坏脾气

旧规则失效,并不意味着提示词会持续变短。模型升级后,一些过去不明显的行为开始影响体验,Opus 5 相比 4.8 多出 72% 的内容正是为此而来。根据陈成的抓取与 Piebald-AI 的提示词库,Opus 5 主要新增两段:Delivering work 和 Corrections。

  • Delivering work:要求模型按用户原本要求的范围交付,普通模糊问题自行判断,只有不同理解会显著改变结果时才停下来询问;不得因发现「更好的方案」而悄悄缩放任务,不得只完成容易的部分就把结果说成已完成,若某部分确实无法推进,也须先完成剩余部分并明确说明缺什么、为何没做。这一段针对的是 Opus 5 自主性增强后容易扩大任务范围的问题。
  • Corrections:Opus 5 比以前更爱向用户解释纠错过程,会指出前面哪句话说错了、详细分析原因、再说明如何调整,长任务里很多更正其实不影响最终结果,只增加输出长度。Corrections 要求只解释真正影响代码、结论或决策的错误,无关小失误直接改掉继续做,不加道歉和开场说明,不反复自我批评,也不逐条统计已犯错误;用户追问不等于之前一定说错,其他 Agent 指出问题时也须先判断对方是否正确。

两段一段防 Claude 做得太多,一段防它说得太多。旧模型先解决能不能完成任务,Opus 5 已能完成更长、更复杂的任务后,产品团队才开始处理任务范围与过程沟通的问题。

苦涩的教训:人类最舍不得删掉自己的聪明

强化学习先驱 Richard Sutton 在 2019 年的《The Bitter Lesson》中梳理了七十年 AI 史:人类总忍不住把经验和解法直接写进机器,短期看规则往往立竿见影,也最让研究者有成就感;可一旦算力上来,这些精心设计的规则很快失效,最后遥遥领先的反而是依靠堆算力的通用方法。教训之「苦涩」,在于被淘汰的恰恰是研究者最得意、投入最多的部分。

Claude Code 这轮提示词删改,正是这一教训的缩影。旧提示词曾让 Claude Code 成为顶级的 Agent 产品,但随着模型继续进化,这些规则开始反过来拖后腿。对所有关注上下文工程的人来说,值得记住的是:不要把自己干活的每一步都写进提示词,让模型永远踩着旧经验的脚印走;更能扛过模型换代的是一套能持续扩展的环境,而具体该走哪条路,最终应该交给模型自己。

信源