桃子桃子快讯
返回首页
行业动态

Fireworks AI 首发托管 Kimi K3:称质量对标官方,吞吐达 165 tok/s

Fireworks AI 宣布率先上线 Moonshot 最新模型 K3,宣称在官方评测中达到最佳质量,AA 基准吞吐…

2026.07.28 · 周二3 分钟阅读

Moonshot(Kimi)旗下新一代模型 K3 正式亮相,AI 推理服务商 Fireworks AI 在 X 平台发文宣布成为首家以「零质量妥协」方式托管 K3 的厂商,并称其服务质量在 Moonshot 官方评测中达到最佳,匹配官方版本质量。同时,Fireworks 表示在 Artificial Analysis(AA)基准下,K3 的推理吞吐量达到 165 tok/s,且「优化工作尚未结束」。

Fireworks 强调「首日对标官方」

根据 Fireworks AI 的官方声明,K3 上线当日该公司即完成接入,并直接将自家服务质量与 Moonshot 官方版本进行对标评测。Fireworks 在声明中写道:「我们是唯一一家在发布当天匹配 @Kimi_Moonshot 质量的提供商」,并附上 Moonshot 官方评测结果截图,称自家为「该评测下的最佳质量提供商」。

这一表述意味着,对于希望尽快在生产环境中使用 K3 的开发者而言,Fireworks AI 提供了一条无需自行部署、即刻可用的路径;同时也意味着 K3 的官方权重或 API 已具备被第三方推理平台托管的条件。

性能指标:AA 基准 165 tok/s

在性能层面,Fireworks AI 给出的核心数字是 165 tokens/秒。该数据来自业内常用的 Artificial Analysis 推理基准,反映的是端到端的文本生成吞吐能力。需要注意的是:

  • 165 tok/s 为 Fireworks 自报数据,尚未见到 AA 官方榜单更新。
  • Fireworks 明确表示「优化尚未完成」,意味着后续吞吐和延迟仍有进一步压缩空间。
  • 实际服务质量还会随提示词长度、并发量、区域节点等因素波动。

K3 本身的规格仍未披露

截至 Fireworks AI 发文时,Moonshot 方面尚未在公开渠道对 K3 的参数规模、上下文长度、训练数据、定价策略等关键信息做系统披露。Fireworks 的公告也未透露 K3 与前代 Kimi K2 之间的差异,仅强调「最佳质量」与「对标官方」。因此,对于关注 K3 能力边界的开发者和研究者而言,模型的官方技术文档与基准对比仍待 Moonshot 后续放出。

试用与接入

Fireworks AI 在原帖中附带了一个试用链接(fireworks.ai),引导用户前往其 Playground 或 API 控制台体验 K3。对于已使用 Fireworks AI 托管 Kimi 系列模型的用户,可关注其后台上线状态与计费方案;对于更看重自托管或使用其他云厂商的用户,则需等待 Moonshot 官方 API 或开源权重公布后再做选择。

整体来看,Fireworks AI 的此次发声更偏向「首发托管 + 性能自证」的市场宣传,但其所引用的 Moonshot 官方评测与 AA 基准均为业内可查证的数据来源,对 K3 的早期可用性评估仍具参考意义。

信源