桃子桃子快讯
返回首页
产品功能

NVIDIA Nemotron 3.5 Lightning 上线 Together AI

Together AI 宣布 NVIDIA Nemotron 3.5 Lightning 模型已在平台上线,定位为同类最…

2026.08.11 · 周二2 分钟阅读

Together AI 在 X 平台宣布,NVIDIA Nemotron 3.5 Lightning 模型已在该云推理平台上正式上线。该模型被官方描述为「同类中最快的开源模型」,主打面向需要持续运行、完成高吞吐量专业化任务的智能体(agent)工作负载。

上线背景

Together AI 是面向开发者与企业用户的 AI 推理云平台,长期托管多家厂商的开源及开放权重模型。Nemotron 系列源自 NVIDIA 的模型研发路线,此前已在多个版本中面向社区与下游应用开放。此次 Together AI 上线 Nemotron 3.5 Lightning,意味着用户可直接通过该平台的 API 接入这一模型,无需自行部署推理基础设施。

定位与适用场景

官方对 Nemotron 3.5 Lightning 的定位强调两点:

  • 速度优先:强调在同档位模型中具备领先推理速度,适合对响应延迟敏感的场景。
  • 智能体场景:面向「always-on agents」,即需要长时间在线、持续处理任务的智能体工作流,例如自动化流水线、大批量数据处理与对话型应用的后台推理。

信息局限

需要指出的是,本次 Together AI 的官宣文案极为简短,未披露以下关键细节:

  • 模型参数量与架构信息(如是否为 MoE 结构、上下文窗口长度等);
  • 推理速度对比的具体基准(benchmark)数据;
  • 在 Together AI 平台上的定价与速率限制;
  • 与前代 Nemotron 3 或同期其他开源模型的性能差异。

因此,关于该模型的实际表现与适用边界,仍有待 NVIDIA 或 Together AI 发布更完整的技术说明与测试数据后进一步评估。开发者如需体验,可访问 Together AI 平台查看模型卡(model card)详情。

信源