模型发布
Qwen3.8-Max 登陆多家推理平台,2.4T 参数主打长上下文与智能体
通义千问 Qwen3.8-Max 以 Day 0 合作形式上线 Fireworks、Together AI、Digita…
2026.08.14 · 周五约 2 分钟阅读
通义千问旗下新模型 Qwen3.8-Max 正式登陆 Fireworks AI、Together AI、DigitalOcean Serverless Inference、Nebius Token Factory 等多家推理平台,并以「Day 0 首发合作伙伴」形式同步上线,开发者可在上述平台第一时间调用该模型。官方将其定位为面向智能体(agent)、重型编码与长上下文场景的「大模型」。
模型规格与主打能力
根据官方在合作公告中披露的信息,Qwen3.8-Max 采用 MoE 架构,总参数量达到 2.4T,每次推理激活 95B 参数,上下文窗口为 1M tokens。该参数规模在当前已公开的国产模型中处于头部梯队,长上下文与大规模稀疏激活的组合,主打复杂推理、代码生成以及需要处理超长文档的应用。
Day 0 多平台同步上线
本次发布的关键特点是与多家海外推理平台的 Day 0 同步合作:
- Fireworks AI:定位为面向智能体、重型编码与长上下文工作的推理服务。
- Together AI:同样作为 Day 0 合作伙伴接入,提供 2.4T 总参、95B 激活、1M 上下文的完整规格。
- DigitalOcean Serverless Inference:通过 DigitalOcean 的无服务器推理产品向开发者开放。
- Nebius Token Factory:以「专用推理」形式接入,扩大可触达用户范围。
对开发者而言,这意味着在模型正式开放的第一天即可在多个主流平台上选择部署方式,而不必等待单一渠道逐步放开。
面向场景与生态意义
官方多次强调该模型在「agents、heavy coding、long-context」方向的能力,结合 1M 上下文窗口与大规模 MoE 结构,预期主要应用包括代码助手、多轮 Agent 工作流、长文档分析与检索增强生成(RAG)等。多家平台 Day 0 上线的策略,也反映出 Qwen 在海外开发者生态中的分发速度正在加快。
