桃子桃子快讯
返回首页
模型发布

Anthropic 发布 Claude Opus 5:更实用的旗舰,价格减半逼近 Fable 5

Anthropic 发布 Claude Opus 5,主打日常高频使用,性能逼近 Fable 5 但 API 价格减半,…

2026.07.27 · 周一6 分钟阅读

Anthropic 于 7 月 25 日正式发布 Claude Opus 5,将其定位为面向日常高频使用的旗舰级模型。该模型在多项软件工程与智能体任务评测中位居前列,最高思考档位下部分成绩已逼近甚至超过 Fable 5,而 API 价格仅为后者的一半。

定位与定价:面向日常的高频主力

Claude Opus 5 并未自称「最强模型」,而是强调在复杂任务中更少遗漏步骤、更倾向主动验证中间结果,并在性能与成本之间取得平衡。目前该模型已成为 Claude Max 的默认选择,也是个人订阅用户(Max/Pro)可调用的最强选项;能力更高的 Fable 5 主要面向 API 与企业客户,个人订阅用户虽然可用,但额度有限。

API 定价与 Opus 4.8 保持一致:每百万 Token 输入 5 美元、输出 25 美元,约为 Fable 5 的一半。需要更高速度的用户可启用 Fast 模式,以约两倍价格换取约 2.5 倍速度。

核心能力:执行与验证成为升级重点

官方成绩单显示,Opus 5 在软件工程、知识工作和智能体任务上的完成效率明显提升。在最高思考档位下,多项成绩已逼近或超过 Fable 5,但在进攻性网络利用与长周期自主生物研究等高风险场景中,受限的 Mythos 5 仍更强。

用户可通过 effort 档位调节推理资源投入:档位越高,复杂问题处理能力越强,但速度更慢、Token 消耗也越多。Anthropic 同时上线两项 Beta 功能:「动态调整工具」解决 Agent 任务因缓存失效抬高成本的问题,「自动回退」防止请求被安全分类器中断后失败。

跑分详解:登顶但未形成断层

Opus 5 在多个评测中成绩突出:

  • Frontier-Bench v0.1:超过所有参测模型,相较 Opus 4.8 提升超过一倍,且单项任务成本更低。
  • CursorBench 3.2:开启 max effort 后,与榜首成绩相差不到 0.5%,单任务成本约为后者一半。
  • Zapier AutomationBench:按相同单任务成本计算,通过率约为 Fable 5 的 1.5 倍。
  • OSWorld 2.0:仅用 Fable 5 单任务成本的三分之一多一点,即超越其最好成绩。
  • ARC-AGI 3:获得 30.2%,高于此前榜首 GPT-5.6 Sol 的 7.8%(注:该结果取自 high 档而非 max 档,max 档成绩尚未公布)。

不过 Opus 5 并非全面领先。在 Humanity's Last Exam 中,不用工具时 Opus 5 得 56.3%,略低于 Fable 5 的 56.5%;开放工具后 Opus 5 升至 64.7%,反超 Fable 5 的 63.9%。这一对比说明:Fable 5 仍有更强的纯模型能力,Opus 5 则更擅长搜索、调用工具、检查结果并持续推进任务。

截至 7 月 25 日,Artificial Analysis 的智能指数榜单上,Opus 5 max 以 61 分排在第一位,仅领先第二名 Fable 5 一分,综合能力优势并不显著。

实际使用:擅长执行,但需要磨合

正面评价集中在编程和可交互内容生成:有用户在 X 上展示 Opus 5 一次性生成的可交互 3D 黑洞可视化器,并实时合成一段电子音乐。但也有开发者反馈,Opus 5 在部分任务中会出现过度思考、推理过程冗长、偏离最初目标的情况,更高的 effort 档位并不一定带来更好结果。

代码审查平台 CodeRabbit 的系统测试显示,Opus 5 更适合写代码,而非独立承担全部代码审查;其在逻辑错误、竞态条件、API 误用等问题上仍可能漏检。独立开发者李默形容它为「做事靠谱但略有个性的同事」:调试能力强,整体高于 Opus 4.8,也是 Fable 5 额度耗尽后的合适替代品。但 Opus 4 时代形成的工作流和提示词不能直接迁移,要获得明显提升,需要根据新模型习惯调整任务拆分、effort 档位与验证方法。

行业布局:密集发布与算力扩张

Anthropic 近期明显加快模型更新节奏:5 月 29 日发布 Opus 4.8,6 月 10 日发布 Fable 5 与 Mythos 5,7 月 1 日上线 Sonnet 5,7 月 25 日发布 Opus 5,不到两个月便完成主要产品线的一轮迭代。

Opus 5 发布当天,英伟达、Meta、微软等 25 家公司和机构联合发表公开信,呼吁美国政府不要过早限制开放权重模型,OpenAI、Anthropic、Google 均未签署。Anthropic 在产品策略上仍以闭源、分级开放和风险控制为主:6 月 12 日美国政府对 Fable 5 和 Mythos 5 实施管制,两款模型一度全面下线;限制解除后,安全限制更少的 Mythos 5 仍只向部分获批机构开放。Opus 5 发现源代码漏洞的能力接近 Mythos 5,但将漏洞转化为实际攻击工具的能力明显较弱,因此成为更易在合规框架下向普通用户与企业开放的选项。

算力方面,Opus 5 发布前两天,Anthropic 宣布将部署最高 2 吉瓦规模的 AMD Instinct MI450 系列 GPU 与 Helios 机架级系统,首批 1 吉瓦计划于 2027 年上半年交付;AMD 还将向 Anthropic 进行最高 50 亿美元的战略股权投资。

综合来看,Fable 5 仍代表 Anthropic 公开可用的模型能力上限,Opus 5 解决的是如何以更低成本把接近旗舰的能力交付给更多用户。它的竞争力,最终取决于能否以更稳定的表现、更少的人工接管和可控的成本,把一项工作真正完成。

信源