桃子桃子快讯
返回首页
行业动态

阿里 RISC-V 处理器 XuanTie C950 跑通 Qwen 27B 模型

据 Reddit 用户分享,阿里平头哥 RISC-V 处理器 XuanTie C950 可本地运行 Qwen 27B 模…

2026.08.19 · 周三2 分钟阅读

近日,Reddit r/LocalLLaMA 板块有用户分享了一则消息:阿里旗下平头哥的 RISC-V 处理器 XuanTie C950 在本地运行了 Qwen 系列约 27B 参数规模的模型,推理速度据称达到 30 tokens/秒。这一成绩若经核实,意味着 RISC-V 架构在大模型端侧推理方面迈出了实质性一步。

事件概览

XuanTie C950 是阿里平头哥推出的高性能 RISC-V 处理器,定位于 AI 与计算密集型负载。Qwen(通义千问)系列则是阿里达摩院的大模型家族,其开源版本在国内外开发者社区中拥有较高活跃度。两者结合,意味着基于国产 RISC-V 指令集运行千亿参数级以下的稠密模型具备了可能性。

为什么值得关注

长期以来,大模型推理高度依赖 GPU 与专用加速器,成本与功耗门槛较高。若 RISC-V CPU 能在可接受速度下运行 27B 级模型,可能带来几方面影响:

  • 推动边缘设备、嵌入式终端的本地化大模型部署
  • 降低推理成本,减少对海外算力与加速卡的依赖
  • 扩展 RISC-V 生态在 AI 场景的应用边界

对开源社区而言,「CPU 也能跑大模型」一直是有吸引力的方向。30 tokens/秒在交互式对话场景中处于可用与勉强可用之间,取决于用户对响应速度的预期。

信息局限与待验证点

需要指出的是,目前该消息仅为 Reddit 用户的分享,缺乏官方公告、技术白皮书或独立测试数据支撑。以下关键信息尚未明确:

  • 测试所用的具体模型版本与量化精度(如 Q4_K_M、INT8 等)
  • batch size、上下文长度、解码策略等推理配置
  • 是否包含模型加载、首 token 延迟等完整指标
  • 30 tokens/秒是平均速度还是峰值速度

在上述条件明确之前,该成绩更适合作为社区线索,而非可验证的官方里程碑。后续若阿里平头哥或 Qwen 团队发布更详细的技术说明,该进展的实际意义将更为清晰。

信源