桃子桃子快讯
返回首页
模型发布

Qwen 旗舰 MoE 模型上线 Fireworks 与 Together AI,提供 Day-0 支持

阿里 Qwen 团队的 2.4T 参数 MoE 旗舰模型当日登陆 Fireworks AI 与 Together AI,…

2026.08.13 · 周四3 分钟阅读

阿里通义千问(Qwen)团队的最新旗舰 MoE 大模型 Qwen3.8-2.4T-A95B 正式上线海外推理平台 Fireworks AI 与 Together AI,均提供 Day-0 支持。该模型总参数量达 2.4T,原生支持 256K 上下文窗口,定位为面向编码、长链路智能体(agent)和大规模上下文场景的旗舰基座。

模型规格与定位

根据两家平台的官方介绍,Qwen3.8-2.4T-A95B 是一款典型的超大规模 Mixture-of-Experts(MoE)架构模型,关键参数如下:

  • 总参数量:2.4T
  • 上下文窗口:256K
  • 架构:MoE(命名中的 A95B 通常对应激活参数规模)
  • 主攻场景:自动智能体(autonomous agents)、重型编码、长上下文处理、智能体式工作流

Together AI 在发布中明确表示,该模型「面向编码与长链路智能体工作流」;Fireworks AI 同样强调其在智能体任务和长上下文场景中的适配性。这意味着 Qwen 团队把这款模型定位为偏工程化与 Agent 化路线的主力选手,而不是单纯的通用聊天模型。

平台支持与生态协同

此次发布最值得关注的,是多家推理平台同步开启 Day-0 支持:

  • Fireworks AI:在模型发布的同一天即开放调用入口,方便开发者立刻接入。
  • Together AI:同样在 day zero 上线,并公开致谢 Qwen 团队、vLLM 项目以及 Inferact,称其为早期测试合作伙伴,并表示将持续优化推理性能。

两家平台同时打出「Day-0」招牌,说明 Qwen 团队在发布前已与上游推理框架(vLLM 等)和下游算力平台完成协同验证。这种「模型 + 推理框架 + 算力平台」一体化的上线节奏,正在成为头部开源权重模型的标准动作,能显著缩短开发者从发布到上手的链路。

对开发者的意义

从开发者侧看,这一发布提供了几条关键信息:

  • 长上下文:256K 窗口可覆盖代码仓库级输入、长文档摘要、多轮工具调用等典型 Agent 场景。
  • 编码与 Agent 优化:平台一致强调该模型在「重型编程」与「长链路 agent」上的表现,意味着基准测试和早期评测可能集中在 HumanEval、SWE-Bench、AgentBench 类任务上。
  • 上手门槛:通过 Fireworks AI 与 Together AI 的 API 调用,开发者无需自行部署 2.4T 量级的超大模型,可在云端直接使用。

目前官方尚未披露完整的 benchmark 跑分与价格信息,Together AI 表示「将继续优化性能,敬请期待」。对于关注开源中文大模型与 Agent 工具链的团队而言,这款模型是近期最值得跟踪的下游基座之一。

信源