开源
Qwen 新版 35B-A3B 模型在 ms-swift 仓库提前曝光
社区在 ms-swift 的一次提交中发现疑似 Qwen 3.8 35B-A3B 模型踪迹,尚无官方确认。
2026.08.15 · 周六约 2 分钟阅读
社区在阿里 ModelScope 团队维护的 ms-swift(大模型微调与部署框架)GitHub 仓库的一次提交中,发现疑似通义千问 Qwen 新版本模型的踪迹,编号或为「Qwen 3.8 35B-A3B」。该线索由 r/LocalLLaMA 用户 BazzyIm 在 Reddit 首发,原帖仅附简短说明「Just wait and see」。
发现经过
提交信息中出现的标识字符串大致为「Qwen 3.8 35B-A3B」,其中「35B」对应模型总参数量,「A3B」对应 MoE 架构下的激活参数量(每次推理激活约 30 亿参数)。这一参数组合与 Qwen3 系列已有的 MoE 思路一致,例如 Qwen3-30B-A3B 与 Qwen3-235B-A22B,意味着该条目很可能代表 Qwen 阵营即将推出的一个新分支或新尺寸版本。
现有信息极为有限
除一条 ms-swift GitHub 提交链接外,原帖没有披露任何额外信息:
- 无官方博客或技术报告佐证;
- 无模型卡、无 tokenizer、无 benchmark 数字;
- 无阿里通义 / Qwen 团队的任何公开回应;
- 「3.8」是否为正式版本号、是否为内部代号、或仅是社区拼接的猜测,均无从考证。
如何看待
ms-swift 仓库通常会在阿里官方正式发布前数天甚至数周,先行合入对新模型的支持代码,这是开源大模型社区常见的「提前发掘」路径。Qwen3 系列多个子版本此前也通过类似方式被先于官方公告曝光,因此本次线索具备一定的可信基础,但距离「实锤」仍差很远。
考虑到 Qwen 系列在中英文开源生态中拥有庞大的本地部署与微调用户群,任何 35B-A3B 量级的新 MoE 模型若属实,都可能迅速进入消费级显卡的可运行区间,并引发新一轮社区评测热潮。读者目前宜以「待官方确认」的态度看待,避免被标题党误导。
