桃子桃子快讯
返回首页
工具

Ramp 推出模型路由服务 Router,一键聚合 27 款大模型

金融科技公司 Ramp 上线 AI 推理路由产品 Router,通过单一接口调度多模型以降低推理成本。

2026.08.20 · 周四3 分钟阅读

美国金融科技公司 Ramp 正式发布 AI 推理路由产品 Router,主打「一个接口、一份账单,接入所有主流模型」的理念,帮助开发者在不同大模型之间按成本与性能自动调度请求。Ramp 方面称,使用 Router 平均可削减约 40% 的 AI 推理成本,并宣称目前每月路由的 Token 量已超过 2.75 万亿。

产品定位与核心功能

Router 的核心思路是充当模型与调用方之间的中间层:开发者无需逐家接入 OpenAI、Anthropic 等供应商,而是把请求统一发送至 Router,再由其根据成本、性能和可用性选择合适的模型执行。Ramp 同时提供 Router Strategies,允许开发者针对不同类型请求自定义成本与性能优先级,或直接使用官方基准默认值。

  • 支持一次性接入,无需锁定单一供应商;
  • 按请求级别动态选择最低成本的可用模型;
  • 支持按列表价格计费,并附带用量与成本追踪。

已支持的模型阵容

根据官方页面,Router 目前已上线 27 款模型,覆盖闭源与开源阵营,包括 GPT-5.5、GPT-5.6 系列(Sol、Terra、Luna)、Claude Opus 5、Claude Sonnet 5、Claude Haiku 4.5、Gemini 3.1 Pro、Grok 4.5、DeepSeek V4 Pro/Flash、Kimi K2.6/K2.7 Code、Qwen3.6/3.7 Plus、GLM 5.1/5.2 等。Ramp 表示会随新模型发布持续扩充支持列表。

自研基准与真实场景验证

为衡量各模型在生产环境中的实际表现,Ramp 推出了名为 Ramp SWE-Bench 的评测基准,源自其自身的真实工程任务,而非仅依赖公开排行榜。公司还披露了一项内部数据:在 Ramp 自身的工作负载中,Router 帮助其 AI 支出降低超过 25%;NVIDIA 在 NeMo Switchyard 案例中采用类似的阶段路由方案后,编码 Agent 的成本下降 59%、运行时间缩短 35%。

定价与开放范围

Router 面向美国地区个人开发者与团队开放,企业级功能即将上线,使用者无需持有 Ramp 卡片或公司账户。官方宣布 Router 在 2026 年底前免费,仅按模型列表价收取 Token 费用,并提供 26 美元额度抵扣。安装方式支持通过官方脚本 agents.ramp.com/install.sh 一键配置。

行业背景

模型路由并非全新赛道,OpenRouter、Portkey、LiteLLM 等已有产品提供类似能力。Ramp 的差异化在于其长期在自身生产环境中运行并迭代该技术,并将内部成本节省的工具对外开放。能否在第三方开发者群体中复制同等收益,仍有待更广泛的使用数据加以验证。

信源