桃子桃子快讯
返回首页
行业动态

Together AI 称 GLM-5.3 在 DeepSWE 上以约 1/5 成本匹配 Claude Fable 5

Together AI 在 X 发文称,GLM-5.3 与 Claude Fable 5 在 DeepSWE 单次解题率…

2026.08.23 · 周日2 分钟阅读

AI 推理云平台 Together AI 在 X 上发文,称其团队在 DeepSWE 软件工程基准上对比了 GLM-5.3 与「Claude Fable 5」两款模型。原文称 GLM-5.3 在单次解题率上与 Claude Fable 5 持平,但成本仅为后者的约 1/5;在允许多次尝试的场景下,GLM-5.3 进一步反超。该平台据此认为,当重试成本足够低时,模型选型的经济性会发生显著变化。

关键信息梳理

  • 对比对象:GLM-5.3 与「Claude Fable 5」,二者来源未在原文中进一步说明。
  • 基准平台:DeepSWE,聚焦软件工程任务的多轮推理与代码生成能力。
  • 核心结论:单次解题率持平;GLM-5.3 成本约为 Claude Fable 5 的 1/5;多次尝试后 GLM-5.3 表现领先。
  • 延伸观点:Together AI 强调「廉价重试」可放大模型性价比,是本次分析的主要立论点。

需核实之处

原文仅作为一条 X 短帖发布,未给出 DeepSWE 上的具体得分、token 价格表、prompt 模板、评测配置或可复现脚本。同时,「GLM-5.3」与「Claude Fable 5」两个名称均未在智谱、Anthropic 官方渠道或主流模型目录中检索到对应发布记录,疑似内部代号、占位名或笔误。在官方信息或第三方复现报告出现前,本结论宜视为厂商自述。

小结

如果数据属实,这将是一个「成本驱动」超越「单次性能」的典型案例,对注重性价比的开发者有参考意义;但鉴于来源单一、模型名称存疑、数值缺失,读者宜保留观望,等待官方或独立机构发布更完整的评测结果后再下判断。

信源