桃子桃子快讯
返回首页
产品功能

Nemotron 3.5 Lightning 上线 Together AI 专用推理

Together AI 宣布通过专用推理服务提供 Nemotron 3.5 Lightning,面向高并发智能体工作负载…

2026.08.11 · 周二2 分钟阅读

Together AI 在 X 平台发布消息,宣布 Nemotron 3.5 Lightning 已通过其「专用模型推理」(Dedicated Model Inference)服务开放使用,为高吞吐量的智能体(agent)工作负载提供预留算力与可预期的性能表现。

上线背景

Nemotron 是 NVIDIA 推出的开放权重大模型系列,专为企业级推理与微调场景设计。本次上线 Together AI 专用推理服务,意味着用户无需自行部署硬件,即可通过云端获取该模型的推理能力,尤其适合对延迟和稳定性有较高要求的智能体应用。

服务要点

  • 专用算力:通过 Dedicated Model Inference 提供预留容量,避免高峰期资源争抢。
  • 面向智能体:官方明确将「高容量智能体工作负载」列为典型场景。
  • 稳定性能:承诺在持续高并发调用下保持可预期的响应表现。

不足与待补充

目前 Together AI 仅发布了一条简短公告,未披露以下关键信息:

  • 模型的具体参数规模与上下文窗口
  • 推理价格与计费模式
  • 与其他推理部署方案的性能对比基准
  • 上线区域与可用时间

小结

这是一条关于 NVIDIA Nemotron 3.5 Lightning 商业化部署渠道扩展的行业动态,体现了 Together AI 与 NVIDIA 模型生态的进一步整合。但公告本身信息密度有限,读者如需了解技术细节与定价,建议关注 Together AI 后续的完整发布或 NVIDIA 官方渠道。

信源