Amp 静默切换默认模型:用户几乎无感
AI 编程工具 Amp 将默认模型从 Claude Opus 4.8 换成 GPT-5.6 Sol,绝大多数用户未察觉亦…
AI 编程工具 Amp 近日上线名为 Dial 的模式选择器,并悄然把默认模型从 Anthropic 的 Claude Opus 4.8(smart 模式)切换为 OpenAI 的 GPT-5.6 Sol(medium 模式)。原本预期会招致大量用户不满,结果却是「零投诉」——Amp 把这一现象写进了官方博客,并附上了生产环境中的具体数据。
一次静默的默认模型切换
在 Dial 上线之前,Amp 的默认模式为 smart,跑的是 Claude Opus 4.8,承担了超过一半的新会话。Dial 上线后,medium 成为新默认,背后运行的是 GPT-5.6 Sol。对一家以编程 Agent 为核心产品的工具而言,从 Anthropic 阵营换到 OpenAI 阵营,被业内视为「应当引发震荡」的一次切换。Amp 提前准备了迁移文档,把旧模式打包成可安装插件,然后等待用户反馈。
反馈是:什么都没有发生,没有收到任何投诉。
生产数据说明了什么
Amp 公开了切换前后的实际使用情况:
- Dial 上线前一天,smart 模式承担 55% 的新会话;
- 上线一周后,该比例降至 0;
- 上周,Dial 四个模式合计承担 93% 的新会话,其中 medium 单独占约三分之二;
- 使用 Dial 的用户中,69% 从未把模式调离 medium;
- Amp 为找回旧模式而发布的插件(保留原提示词与模型,一键安装)几乎无人安装。
这意味着,绝大多数用户在不知情或知情后都默认接受了 GPT-5.6 Sol 顶替 Claude Opus 4.8 这一变化。
前沿模型的差距正在缩小
Amp 在博文中给出了自己的解读:前沿模型之间的差异已经很小,小到针对单个工程师的单个任务,切换模型在结果上几乎看不出差别。Amp 表示自己仍在持续对模型进行基准测试并按需轮换,因为「微小差异会随会话量累积」,但这不应当成为单个用户日常需要操心的事情。
换言之,默认设置之所以能保持高质量,是因为有人在专门负责这件事,终端用户无需投入精力。
真正影响产出的三件事
Amp 认为,真正决定输出质量的并非模型本身,而是以下三个因素:
- 任务难度:任务越难,对模型与工作流的要求越高;
- 上下文质量:喂给模型的上下文(代码、约束、背景)比换哪个模型更关键;
- 产出评审:对模型输出的人工复核力度,直接影响最终结果。
Dial 覆盖了第一项——用户只需声明任务难度,对应的档位会调用当前基准测试下表现最优的模型,模型选择由 Amp 持续重测后动态调整。Amp 将其余两项交给产品其余部分配合用户完成。
这一观察呼应了 2024 年以来业界关于「模型商品化」的讨论:当顶级模型能力趋同,竞争焦点会从「用谁的模型」转向「怎么用模型」,包括上下文工程、工作流设计和人机协作的评审环节。
