开源
NVIDIA 开源 Nemotron 3.5 Lightning:30B MoE 模型登场
NVIDIA 推出 Nemotron 3.5 Lightning 开源模型,采用 30B 总参数 / 3B 激活参数的…
2026.08.11 · 周二约 2 分钟阅读
NVIDIA 近日宣布推出 Nemotron 3.5 Lightning 模型,这是一款采用 MoE(混合专家)架构的开源大模型,总参数量为 30B、每次推理激活 3B 参数,主打推理速度与同尺寸模型相当水平的性能表现。作为 Nemotron 系列的最新成员,「Lightning」之名直接点明了其面向低延迟、高吞吐推理场景的定位。
模型架构与核心规格
Nemotron 3.5 Lightning 采用了当前主流的 MoE 设计:
- 总参数量:30B
- 激活参数:3B
- 架构:Mixture of Experts(混合专家)
- 定位:速度优先的轻量化推理模型
通过将总参数做大、单次激活参数做小,模型在保持较强能力上限的同时,显著降低了单次推理的计算开销,这也是 2025 年以来中尺寸模型的主流技术路线。
性能与速度表现
根据 NVIDIA 公布的信息,Nemotron 3.5 Lightning 在速度维度上对同尺寸模型形成明显领先:
- 据称比 Qwen3 35B 快约 35%(原文转述,具体版本号表述可能存在笔误)
- 在同参数级别的模型中速度领先
- 性能与同尺寸主流模型持平
需要指出的是,原始信息为社交媒体转述,缺少具体的 benchmark 数据与方法学说明,35% 这一速度优势的复现条件与对比口径目前并不透明。
开源与可用性
本次发布最值得关注的一点是模型的开放程度:
- 权重已在 Hugging Face 平台公开发布
- 社区可下载并自行进行测试与微调
- 标志着 NVIDIA 继续在开源权重赛道加大投入
对开发者而言,这意味着可以直接基于 Nemotron 3.5 Lightning 进行二次开发、部署评测以及垂直场景适配,从而进一步丰富开源大模型生态的选择空间。
