行业动态
Reddit 讨论 Qwen 版本 Artificial Analysis 指数跳升
r/LocalLLaMA 用户整理 Qwen 系列在 Artificial Analysis 指数上的得分变化,推测下一…
2026.08.18 · 周二约 2 分钟阅读
在 r/LocalLLaMA 社区,用户 Gear5th 整理了 Qwen 系列模型在 Artificial Analysis 指数上的得分趋势,指出该分数在 3.5 → 3.6 → 3.8 三个版本之间出现明显跳升,并由此推测下一代 MoE 版本可能带来更大性能飞跃。
Artificial Analysis 指数变化
根据帖文提供的数据,三代 Qwen 27b 稠密模型的指数得分依次为:
- Qwen 3.5 27b:35
- Qwen 3.6 27b:38
- Qwen 3.8 27b:52
发帖人指出,从 3.6 到 3.8 之间分数跳升约 14 点,幅度远超前两个版本之间的过渡。原帖同时承认,即使考虑到可能的「刷榜」成分,这一增幅仍然「令人意外」。
现役 MoE 版本对比
帖中把现有 MoE 构型作为参照点:
- Qwen3.6 35b A3b 得分:32
该模型得分为 32,比同代 27b 稠密模型低约 6 分;由于每个 token 只有约 3b 参数激活,推理速度据帖文估计约为稠密版本的 5 倍。
社区推测
发帖人进一步设想,若假设中的 3.8 35b A3b 版本得分能超过 Opus 4.5(指数约 42),将构成相对现有 MoE 版本的明显提升。
需要说明的是,本文涉及到的「Qwen 3.8」「3.6 35b A3b」等具体版本号及对应得分均直接转录自 Reddit 原帖摘要,并未在阿里巴巴官方发布资料中得到交叉验证;发帖人也明确表示该内容带有推测成分,相关推断目前仍停留在社区讨论层面。
