行业动态
Together AI:Kimi K3 Max 每美元解题数约为 Fable 5 xhigh 的 2.8 倍
Together AI 公布 DeepSWE 分析,Kimi K3 Max 在 Pass@1 上接近 Fable 5 x…
2026.08.03 · 周一约 1 分钟阅读
Together AI 在其官方 X 账号上公布了基于「DeepSWE」基准的对比分析结果,展示了 Kimi K3 Max 与 Fable 5 xhigh 两款模型在软件工程类任务上的成本与表现差异。
核心数据
- Pass@1 表现:Kimi K3 Max 接近 Fable 5 xhigh 的水平;
- 单次推理成本:Kimi K3 Max 约为 Fable 5 xhigh 的三分之一;
- 单位成本产出:综合计算后,Kimi K3 Max 每美元可成功解决的任务数约为 Fable 5 xhigh 的 2.8 倍。
衡量口径
Together AI 在帖中指出,对于大规模运行模型的团队来说,「每成功任务所花费的成本」往往比单一基准分数更具实操参考价值。这一结论基于其内部 DeepSWE 分析。
解读与局限
该数据来自 Together AI 一条短帖,DeepSWE 的具体测试条件、任务构成,以及 Fable 5 xhigh 的模型规格与定价细节并未在公开内容中披露。读者在参考「2.8 倍」这一结论时,需结合自身工作负载、调用方式与实际计费策略,谨慎判断是否可在自身场景中复现。
