Yadda 3.0 发布:Claude Code 主导现代化,并行智能体编排成新瓶颈
JavaScript BDD 库 Yadda 发布 3.0 版本,大部分现代化工作由 Claude Code 完成,作者…
核心事件
JavaScript 行为驱动开发(BDD)库 Yadda 近日发布 3.0.0 版本,作者借助 Anthropic 的 Claude Code(基于 Opus 4.8)完成了绝大部分代码现代化工作,整个流程耗时约一天。该版本是一个面向 Node.js 的现代化重写,移除了 CasperJS、PhantomJS、Bower、Component 等已过时的集成,测试套件迁移至 node:test,源码统一为 ES6 语法,并新增了对 Playwright、Puppeteer 等现代工具的示例以及 TypeScript 类型定义。
值得注意的是,Yadda 3.0 的工作拆解(Yadda 3.0 epic)本身也是由 Claude 撰写的,并被划分为多个独立阶段:移除过时功能、更新工具链、机械格式化、源码现代化、API 变更探索、示例与 CI 更新、最后处理元数据、文档和 TypeScript 类型。作者强调,他刻意要求 Claude 不在同一阶段同时修改生产代码与对应测试,以保留测试套件作为外部约束的有效性。
AI 编码能力的变化
作者在文章中回顾了自己今年早些时候关于「氛围编程(vibe coding)」体验两极分化的讨论。当时的结论是:结果极大程度上取决于智能体的使用方式,在紧密约束和监督下,Claude 能极快地产出高质量代码;放任不管则容易出现架构漂移和不必要的代码。仅过了七个月,模型能力已大幅跃升,但作者认为这仍然只是表面变化。
并行智能体与编排瓶颈
文章更具行业参考意义的观点集中在后半段。作者指出,当单个开发者不再局限于与一个编码智能体对话,而是同时调度多个智能体并行工作时,开发速度可显著提升。可行的方案包括:
- 同时运行多个 Claude Code 会话;
- 利用 Git worktree 为每个智能体提供独立工作副本;
- 使用 cmux 等工具管理多个 Claude 会话;
- 通过 Claude Code Agent View 监控各会话状态与待处理任务。
然而,作者很快遇到新的瓶颈:人自身的并行管理能力。他表示自己最多能舒适地并行推进三到四个任务,再多就会丢失上下文、忘记决策与待审阅项。此时,模型与机器均未过载,过载的是协调工作的人类。作者由此判断,「良好的编排(orchestration)」将是 AI 软件开发中的下一个关键层次。
其同事 Marco 在《My AI Engineering Journey》一文中也描述了类似演进路径:从 AI 作为自动补全,到受监督、可信赖的智能体,再到并行智能体——最终认知负荷成为约束,并因此开发了围绕 Claude Code 与 worktree 的编排界面 Otto,进而构建协调实现、评审、反馈与文档的智能体流水线。
行业启示
文章最后指出,AI 辅助软件开发仍在以极快速度演进:个体编码能力已大幅提升,并行执行已具实用性,下一个约束日益转向对这些能力的整体协调。编排工具与方法的迭代速度甚至已超过模型本身的更新,成为当下更值得关注的层面。
