Anthropic 传上线 Claude Fable 5.1 与 Mythos 5.1
测试资讯账号报道 Anthropic 上线 Claude Fable 5.1 与 Mythos 5.1,在多项基准上较前…
据 TestingCatalog 等 X 平台账号报道,Anthropic 已上线两个新模型版本——Claude Fable 5.1 与 Claude Mythos 5.1,并已在 Claude、Claude Code 以及第三方 IDE Cursor 中陆续推送。需要指出的是,「Fable」「Mythos」并非 Anthropic 既往公开的命名体系,相关报道目前以二手推文为主,官方博客尚未给出完整说明,读者宜以官方后续公告为准。
基准表现:较前代显著提升
根据来源中给出的数据:
- 在 Terminal-Bench-Science 0.1 上,Fable 5.1 / Mythos 5.1 得分为 52.6%,是前代 Fable 5 的两倍以上。
- 在 Terminal-Bench 4.0 上,得分由 Fable 5 的 42.0% 提升至 55.8%。
- Cursor 方面称,Claude Fable 5.1 在其内部 CursorBench 3.2 上以最大力度运行取得 73.4% 的成绩,为该平台目前评测过的「最强模型」。
这些数字若属实,意味着新版本在编码与科学推理类任务上相较既有版本有较为明显的代际跨越。
功能侧改进
报道列出几项新版本主打能力:
- 输出语言更平实,紧扣用户指令,减少冗余发挥。
- 可直接生成可用的电子表格,并在过程中逐项校验数字。
- 在回答中显式标注引用来源,区分「已知事实」与「估计/推测内容」。
Cursor 的评价与上述描述相互呼应,称 Fable 5.1 在「自验证」方面尤其出色,能够从零开始独立完成较难的编码任务。
价格与 API 变化
报道称,新版本定价与上一代 Fable 5 保持一致,但需要额外的用量额度;同时 API 缓存读取费用相比 Fable 5 降低约 75%。此外,Anthropic 似乎更新了 Messages API 的「Thought Preserved」支持页面,调整对思维块(thought blocks)的处理方式,以防止被用于模型蒸馏。
待官方确认
由于「Fable 5.1」「Mythos 5.1」等名称与 Anthropic 已发布的 Sonnet、Opus、Haiku 系列命名不一致,且主要信息源为测试资讯类账号与第三方 IDE 在 X 平台的推文,目前仍属于「早期流出 / 预告」性质。在 Anthropic 官方博客或 changelog 正式确认之前,建议开发者将其视为预告信息,谨慎用于生产环境的核心链路。
