桃子桃子快讯
返回首页
产品功能

NVIDIA Nemotron 3.5 Lightning 上线 Fireworks AI,主打高吞吐 Agent 场景

Fireworks AI 上线 NVIDIA Nemotron 3.5 Lightning(30B MoE、3B 激活参…

2026.08.11 · 周二2 分钟阅读

推理平台 Fireworks AI 宣布上线 NVIDIA Nemotron 3.5 Lightning 模型。该模型采用 30B 总参数、3B 激活参数的 MoE 架构,由 NVIDIA Nemotron 3 Ultra 蒸馏而来,定位为面向智能体(Agent)场景的高吞吐专用模型。

模型定位:专用而非通用

与追求通用能力的主流大模型不同,Nemotron 3.5 Lightning 强调「为专门化而生」的设计思路。Fireworks AI 在官方介绍中将其定位为「高容量 Agent 引擎」,意在替代部分场景下对响应速度和成本更敏感的通用模型选择。其稀疏激活结构(30B 总参数仅激活 3B)有助于在保持能力的同时降低单次推理开销。

基准表现:可靠性指标突出

根据 Fireworks AI 公布的信息,Nemotron 3.5 Lightning 在以下两项基准中表现靠前:

  • PinchBench:智能体相关评测中取得「强劲表现」。
  • AA-Omniscience Non-Hallucination:在反幻觉指标上达到顶级水平。

两项指标均指向智能体落地中的关键痛点——执行稳定性与回答可靠性,但 Fireworks AI 未披露具体分数或与其他模型的对比数据。

上线平台与适用场景

开发者可通过 Fireworks AI 平台调用该模型,适用于需要高频调用、对延迟与成本敏感、且容忍适度能力裁剪的 Agent 工作流,例如自动化任务编排、多步骤工具调用等场景。Fireworks AI 此前已托管多款主流开源权重模型,Nemotron 3.5 Lightning 的加入进一步丰富了其面向 Agent 的模型选项。

信源