桃子桃子快讯
返回首页
开源

NVIDIA 开源 Nemotron 3.5 Lightning:30B MoE 模型登场

NVIDIA 推出 Nemotron 3.5 Lightning 开源模型,采用 30B 总参数 / 3B 激活参数的…

2026.08.11 · 周二2 分钟阅读

NVIDIA 近日宣布推出 Nemotron 3.5 Lightning 模型,这是一款采用 MoE(混合专家)架构的开源大模型,总参数量为 30B、每次推理激活 3B 参数,主打推理速度与同尺寸模型相当水平的性能表现。作为 Nemotron 系列的最新成员,「Lightning」之名直接点明了其面向低延迟、高吞吐推理场景的定位。

模型架构与核心规格

Nemotron 3.5 Lightning 采用了当前主流的 MoE 设计:

  • 总参数量:30B
  • 激活参数:3B
  • 架构:Mixture of Experts(混合专家)
  • 定位:速度优先的轻量化推理模型

通过将总参数做大、单次激活参数做小,模型在保持较强能力上限的同时,显著降低了单次推理的计算开销,这也是 2025 年以来中尺寸模型的主流技术路线。

性能与速度表现

根据 NVIDIA 公布的信息,Nemotron 3.5 Lightning 在速度维度上对同尺寸模型形成明显领先:

  • 据称比 Qwen3 35B 快约 35%(原文转述,具体版本号表述可能存在笔误)
  • 在同参数级别的模型中速度领先
  • 性能与同尺寸主流模型持平

需要指出的是,原始信息为社交媒体转述,缺少具体的 benchmark 数据与方法学说明,35% 这一速度优势的复现条件与对比口径目前并不透明。

开源与可用性

本次发布最值得关注的一点是模型的开放程度:

  • 权重已在 Hugging Face 平台公开发布
  • 社区可下载并自行进行测试与微调
  • 标志着 NVIDIA 继续在开源权重赛道加大投入

对开发者而言,这意味着可以直接基于 Nemotron 3.5 Lightning 进行二次开发、部署评测以及垂直场景适配,从而进一步丰富开源大模型生态的选择空间。

信源