行业动态
Together AI 下调 H100 专用推理时租至 3.99 美元
Together AI 在 9 月将 H100 专用推理时租价格从 5.49 美元降至 3.99 美元,新老部署自动适用…
2026.09.01 · 周二约 2 分钟阅读
AI 云服务厂商 Together AI 在其官方 X 账号宣布,9 月期间将其 H100 专用推理(Dedicated Inference)服务的时租价格由原来的 5.49 美元/小时下调至 3.99 美元/小时,降幅约为 27%。无论是新部署还是已有部署,都将自动适用这一更低价格。Together AI 同时提示,用户可以在降价后的 H100 实例上部署 Gemma 4、Qwen3/3.5、GPT-OSS、Llama、Nemotron 3.5 Lightning 等主流开源模型,也可以自带 LoRA 适配器运行微调后的模型。
价格调整要点
- 适用服务:H100 专用推理(Dedicated Inference)
- 调整前价格:5.49 美元/小时
- 调整后价格:3.99 美元/小时
- 生效范围:新部署与现有部署均自动适用
- 生效时间:2025 年 9 月
支持的模型与部署方式
Together AI 在公告中列举了几类可直接部署的模型与个性化方案:
- 开源大模型:Gemma 4、Qwen3/3.5、GPT-OSS、Llama
- 轻量化推理模型:Nemotron 3.5 Lightning
- 自定义微调:支持用户自带 LoRA 适配器,在 H100 实例上运行个性化模型
对开发者的意义
对正在或计划使用 Together AI 专用推理资源的团队而言,本次降价在短期内降低了推理算力的单位成本,尤其对需要长时占用 H100 跑大模型或微调变体的项目来说,账单压力会有所缓解。考虑到 Together AI 同时提供主流开源权重模型的托管和 LoRA 部署能力,本次调价对其生态内的用户而言是一个直接的利好。需要注意的是,公告仅说明降价适用于 9 月,后续是否会延续该价格,Together AI 未给出明确承诺,开发者在大规模采购前仍需关注官方后续通知。
