桃子桃子快讯
返回首页
模型发布

阿里发布 Qwen3.8 Flash 多模态 MoE 模型

阿里推出 Qwen3.8 Flash,125B 参数 MoE 多模态架构,原生 262K 上下文可扩展至 1M,是 Qw…

2026.08.26 · 周三2 分钟阅读

阿里通义千问团队发布了 Qwen3.8 Flash 模型,这是一款 125B 参数的多模态 Mixture-of-Experts(MoE)模型,被定位为下一代 Qwen4 架构的前身,预示着 Qwen 系列的下一阶段技术路线。

模型规格与上下文能力

Qwen3.8 Flash 采用 125B 参数的 MoE 架构,支持多模态输入。模型原生上下文窗口为 262K tokens,通过 YaRN 技术可进一步扩展至 1M tokens,能够覆盖长文档分析、代码库理解与多轮复杂对话等典型应用场景。

API 定价

模型已在 QwenCloud API 上架,价格如下:

  • 输入:0.16 美元 / 1M tokens
  • 输出:0.47 美元 / 1M tokens

以百亿级 MoE 模型的标准衡量,这一价位处于较低水平,对大规模调用方较具吸引力。

架构定位与基准表现

Qwen3.8 Flash 基于全新架构设计,是 Qwen4 即将采用架构的前置版本,意味着后续 Qwen4 大概率会延续这一技术路线。在面向软件工程任务的公开基准上,模型成绩如下:

  • DeepSWE 1.1:58.7
  • SWE-bench Pro:62.5

行业意义

作为 Qwen 系列的最新迭代,Qwen3.8 Flash 在多模态、长上下文与代码能力三个方向同时推进,是阿里在开源大模型生态中的又一次重要布局。对中文开发者与企业用户而言,Qwen 系列凭借开源权重与本地部署能力,已是主流选项之一;Qwen3.8 Flash 的发布也为用户评估未来 Qwen4 提供了参考样本。

注:本文信息来自 TestingCatalog 在 X 平台发布的整理内容,详细技术报告与官方公告尚未公布,后续以阿里通义千问官方为准。

信源