桃子桃子快讯
返回首页
产品功能

通义千问 Qwen3.8-27B 上线 Cerebras 推理平台

阿里通义千问团队宣布 Qwen3.8-27B 模型已在 Cerebras 推理平台上线,主打高速推理。

2026.09.12 · 周六2 分钟阅读

阿里通义千问团队在官方 X 平台宣布,旗下 Qwen3.8-27B 模型已在 AI 芯片公司 Cerebras 的推理服务上正式运行,主打「rapid inference」快速推理能力,并邀请用户前往 Cerebras 平台体验。

部署概况

通义千问通过其官方 X 账号发布消息,确认 Qwen3.8-27B 已接入 Cerebras 推理栈。Cerebras 以晶圆级集成(WSE)芯片闻名,长期在第三方基准中以低延迟、高吞吐作为卖点,定位企业级大模型推理场景。本次接入意味着该模型可以在 Cerebras 自有云端或合作云上为开发者提供推理端点。

信息缺口

值得注意的是,官方推文仅给出模型名称与「快速推理」的口径,并未披露以下关键细节:

  • 具体推理速度(token/s、首 token 延迟等)
  • 支持的上下文长度
  • 与 GPU 方案(如 NVIDIA H100/H200)的对比基准
  • 定价、可用区域与计费方式
  • 是否同步上线 API 与开源权重

因此,目前只能视为一次接入公告,性能与商业层面的实际表现仍需后续实测或第三方评测验证。

行业背景

Qwen 系列是阿里通义千问团队推出的开源大模型家族,已在 Hugging Face、ModelScope 等社区广泛使用,并衍生出多尺寸、多模态版本。此次与 Cerebras 的合作,是 Qwen 模型在第三方加速硬件上的又一次落地,有助于在海外非 NVIDIA 算力路径上扩展可访问性。对于关注非 GPU 推理方案的开发者而言,这是值得跟踪的一条进展。

信源