产品功能
通义 Qwen3-Max 登陆 SiliconFlow 与 DeepInfra
阿里通义千问宣布 Qwen3-Max(2.4T 总参数 / 95B 激活参数)已在 SiliconFlow 和 Deep…
2026.08.15 · 周六约 2 分钟阅读
阿里通义千问日前通过官方 X 账号宣布,旗下 Qwen3-Max 模型已在 SiliconFlow 与 DeepInfra 两大第三方推理平台同步可用,开发者可直接通过 API 调用。这是该模型在「Day 0」即完成跨平台部署,意味着模型发布当天就能在主流托管平台上获取服务。
模型基本信息
从官方披露的命名信息来看,本次上线的型号为 Qwen3-Max-2.4T-A95B:
- 总参数规模约 2.4T,采用 MoE(混合专家)架构
- 激活参数约 95B,单次推理仅激活部分专家网络
- 通义将其定位为「Max-level intelligence」,作为当前 Qwen 系列的旗舰级模型对外提供
官方在两条推文中分别使用了「Max-level intelligence, served fresh on Day 0」与「Max-level intelligence, one API call away」的表述,强调即开即用与单次 API 即可触达顶级能力。
双平台同步上线
本次部署选择了海外开发者社区使用率较高的两家推理托管服务商:
- SiliconFlow:通义在原推中感谢了 SiliconFlow 团队(@SiliconFlowAI),并以「From idea to implementation in one go」形容部署速度
- DeepInfra:同步登陆该平台,官方鼓励开发者「Take a deep dive on DeepInfra」(@DeepInfra)体验
两家平台均提供按 token 计费的 API 接入方式,开发者无需自行部署大规模 MoE 模型,即可调用 Qwen3-Max 的推理能力。
对开发者的意义
旗舰级 MoE 模型在第三方平台「Day 0」同步上线,主要价值在于:
- 降低使用门槛,省去自行采购 GPU、搭建推理框架的成本
- 海外开发者可通过熟悉的 API 渠道直接体验
- 与通义官方渠道形成互补,便于 A/B 对比与成本控制
由于官方本次仅披露部署信息,并未在原文中给出具体的 benchmark 跑分、价格或上下文窗口等细节,相关数据有待后续通义或平台方进一步公布。
