产品功能
Together AI 推出抢占式 GPU 算力,价格为按需实例的 50%
Together AI 上线 preemptible compute 公开预览,使用同款 NVIDIA GPU,按需价格…
2026.09.11 · 周五约 2 分钟阅读
AI 基础设施服务商 Together AI 在 X 平台宣布,为其 GPU 集群推出「preemptible compute(抢占式计算)」产品,现已进入公开预览阶段。该服务使用与现有产品相同的 NVIDIA GPU 基础设施,但定价仅为按需实例的 50%,主要面向评估、微调、批量推理以及短时实验等场景。
什么是抢占式计算
抢占式计算是一种常见的云计算定价模式:用户以显著低于正常按需实例的价格获得算力资源,但云厂商可以在需要时回收这些资源,通常用于处理可中断、可重试的工作负载。Together AI 此举将这一模式引入到 AI 训练与推理场景中。
关键参数与适用场景
根据官方说明,该产品具备以下要点:
- 底层硬件:与 Together AI 现有 GPU 集群相同的 NVIDIA GPU 基础设施。
- 定价:按需实例价格的 50%。
- 典型用途:模型评估(evals)、微调(fine-tuning)、批量推理(batch inference)以及短时实验。
- 中断保护:实例被回收前,用户最多有 5 分钟时间进行检查点(checkpoint)保存,以便任务可以从中断处恢复。
面向谁、对生态意味着什么
Together AI 的客户群体包括大量 AI 研究团队与初创公司,此类用户对算力成本敏感,且工作负载本身具备容错性——例如一次评估任务的 checkpoint 可在抢占发生时保存,几十秒到几分钟后重启即可继续。对 Together AI 而言,这有助于提升集群利用率并吸引价格敏感型用户;对更广泛的 AI 生态而言,则是云端 GPU 价格进一步下探的一个信号,但短期内不会改变主流云厂商的整体定价格局。
目前该功能仍处于公开预览阶段,Together AI 未在推文中披露具体的 GPU 型号档位与可用区域,详情可通过其官网获取。
