开源
Qwen 新一代超大模型现身 Hugging Face,2.4T 参数引关注
Reddit 用户称 Qwen 一款参数量约 2.4T 的新模型已上线 Hugging Face,27B 版本同期未发布…
2026.08.12 · 周三约 2 分钟阅读
Reddit 社区 r/LocalLLaMA 出现一条引发关注的帖子,称阿里通义千问团队疑似在 Hugging Face 上架了一款参数量约 2.4 万亿(2.4T)的新模型,发布距发帖约 5 小时。原帖标题为「Qwen 3.8 2.4T is out, no 27b today RIP」,发帖人原本期待 Qwen 同时放出 27B 版本,但当日仅见到这一大体量模型上线,27B 版本暂未同步释出。
社区披露的要点
- 平台:帖子指模型已在 Hugging Face 列出,但未提供具体的仓库链接或模型卡截图。
- 命名:帖中称作「Qwen 3.8」,与此前 Qwen2.5、Qwen3 系列命名不完全一致,命名准确性有待官方确认。
- 参数规模:提到约 2.4T 参数,若属实,将显著超越此前公开的 Qwen3-235B-A22B 等 MoE 模型,但具体架构(是否为稀疏 MoE、激活参数量)尚无说明。
- 27B 版本:原帖附带 ModelScope 链接指向「Qwen3.8-27B」页面,意味着该体量版本或已存在但未在当日发布。
信息可信度与局限
目前该消息来源为单一 Reddit 用户帖文,未附带官方博客、论文、Hugging Face 模型卡或详细参数对比,亦无 benchmark 数据支撑。"Qwen 3.8" 的版本号、社区估算的 2.4T 参数规模,以及「已发布」状态,均有待通义千问官方渠道(如官方 GitHub、ModelScope 官方仓库或公众号)进一步确认。在此之前,相关数字与命名应视为社区传闻而非定论。
行业关注点
若 Qwen 真的释出 2.4T 级别的开源权重模型,对国内乃至全球开源大模型生态将是重要节点:一方面将进一步拉高开源模型参数上限,另一方面也将考验推理部署、显存优化与量化方案的工程能力。截至本文成稿,尚未检索到通义千问方面对该模型发布的正式公告。
