Anthropic 两周提速 claude.ai 三倍:Claude Agent 全程操盘
Anthropic 用内部模型(接近 Opus 5.5)在两周内合并三千余项改动,将 claude.ai 核心路径提速约…
今年 8 月,Anthropic 团队在两周冲刺内把 claude.ai 网页版与桌面端的核心体验提速了约 3 倍,并把过程完整复盘成一篇工程博客。这次提速由 Anthropic 自家的 Claude Agent 深度参与:识别瓶颈、构建基准、上线改动、盯防每一次发布,整条链路几乎都由 AI 协作完成。
关键数据
团队从用户反馈中发现「慢」并非错觉,并锁定了四条覆盖 95% 用户活动的核心路径。在 P75 时长上:
- 冷启动 claude.ai 到可键入页面:3.1 秒 → 0.55 秒
- 启动新的 Claude Code 会话:0.8 秒 → 0.3 秒
- 加载 Claude Cowork 云会话:2.6 秒 → 0.73 秒
合计下来,团队估算每天为用户节省数万小时的等待时间。整个冲刺合并了三千余处代码变更,没有出现任何面向客户的故障或回滚。
冲刺方法
团队先在 Slack 中拉了一个频道,把 Claude 拉进每一个讨论线程。其角色明确:监控发布性能回归、维护可观测看板、主动修复可摘的「低垂果实」、提出性能项目机会、向人类同事汇报。
冲刺开始前,Claude 通过 Datadog MCP 分析了使用数据,识别出四个影响最大的用户旅程——启动应用、开始对话、加载已有对话、发送消息——并把它们拆成 13 个跨网页、桌面端和各产品的可对比测量。团队先列出约 20 个手工挑选的项目,并让 Claude 估算每个项目的毫秒级影响,聚合后设定冲刺目标。结果到第三天,13 个目标已命中 12 个。
典型优化
针对启动速度,团队把一个静态编辑器直接烘焙进 HTML,让用户在 React 初始化时即可键入,并为桌面端外壳的主进程预编译 V8 代码缓存,跳过冷启重编译。针对导航速度,团队在会话间常驻编辑器组件、悬停时预取会话,并把侧边栏的重渲染削减了 90%。
除了预排项目,团队还给 Claude 留出空间,让其自行发现新机会、提出新工作流。这些「Claude 提议的工作流」很快反超最初目标,团队顺势刷新目标、继续向上爬升。
「任何指标都可爬升」的实验室基准
为了让迭代节奏快于线上发布节奏,团队建立了一套实验室基准体系。Claude 找出方向后,团队在 11 分钟内拉起五条独立线程,分别测量:Valgrind 指令数、V8 调用计数、React commit 数、样式重计算、DOM 变更数。
每条基准有双重使命:一是给 Claude 一个在实验室里可以推动的指标;二是在 CI 中作为只能递减的护栏。若基准抖动或与用户实际延迟无关,团队直接丢弃,避免 Claude「爬错山」。
最终,这些实验室指标需要被证明与真实墙钟时间相关,团队才会保留;否则立即下架。这种「指令数确定性 + 墙钟相关性验证」的组合,让 Claude 可以在没有线上读数的情况下持续优化。
