路由器(网站)
摘要
Ramp公司推出的Router工具可通过将请求路由至满足性能需求的最低成本模型,最高降低40%的AI推理成本,并为多模型提供单一接入点。
Router通过将每个请求匹配到满足性能要求的最低成本模型来降低推理成本。它实时响应延迟和故障率。Router平均可将AI成本降低40%。工程团队为每个工作负载获得最佳模型,财务团队则获得更低的推理支出。
查看缓存全文
缓存时间: 2026/08/20 15:36
# Ramp Router
来源:https://router.com/
router.com 帮助您节省时间与资金
## 数秒内削减推理成本。
一个端点、一张账单、所有模型——平均降低40%的AI成本。这是最大化投资回报的关键拼图。
01 所有模型共享一个密钥
02 推理成本直降40%
03 支持万亿级Token扩展
2026年前免费路由 | 26美元模型积分
Router 旨在通过为每个请求匹配满足性能需求的最低成本模型,来降低推理成本。
智能体调用代码
`curl \-fsSL https://agents\.ramp\.com/install\.sh \| sh && ~/\.local/bin/ramp router configure`
已启用Switchyard的Router CLI会话,将45.62美元的Router运行成本与297.85美元的通用前沿模型成本进行对比
基于18个每日样本的成本影响数据
样本 | 总成本指数 | 灵活路由占比
--- | --- | ---
1 | 100 | 1
2 | 98 | 2
3 | 97 | 5
4 | 94 | 5
5 | 93 | 8
6 | 91 | 10
7 | 79 | 0
8 | 12 | 8
9 | 88 | 15
10 | 98 | 51
11 | 91 | 0
12 | 84 | 22
13 | 11 | 8
14 | 26 | 12
15 | 81 | 3
16 | 11 | 37
17 | 93 | 9
18 | 14 | 77
19 | 43 | 15
20 | 75 | 48
21 | 16 | 73
22 | 57 | 17
23 | 72 | 65
24 | 18 | 70
25 | 73 | -
## 用户如何评价Router
成本
模型(27)
- Claude Fable 5
- Claude Opus 5
- Kimi K3
- Claude Opus 4.7
- GPT-5.5
- GPT-5.6 Sol
- GLM 5.2
- Grok 4.5
- Kimi K2.7 Code
- Claude Opus 4.6
- DeepSeek V4 Flash
- Claude Opus 4.8
- GPT-5.6 Terra
- Claude Sonnet 5
- GPT-5.4
- Gemini 3.1 Pro
- GPT-5.6 Luna
- Claude Sonnet 4.6
- Kimi K2.6
- GLM 5.1
- Qwen3.6 Plus
- DeepSeek V4 Pro
- Qwen3.7 Plus
- GPT-5.4 Mini
- Claude Haiku 4.5
- GPT-5.4 Nano
- GPT-4.1
平均值
90% | 75% | 60% | 45% | 30% | 15%
--- | --- | --- | --- | --- | ---
$0.00 | $0.50 | $1.00 | $1.50 | $2.00 | $2.50 | $3.00
解决率 | 成本(平均)
## 基于真实工作构建的基准测试。
我们基于真实的生产工程工作构建了Ramp SWE-Bench,因为公开的排行榜无法解答我们的疑问。它让我们更清晰地了解每个模型能解决什么问题以及相应成本。
## 在Ramp内部投入使用。
Ramp为Router提供了真实的实战环境。我们在生产中获得的经验直接反馈到产品中。
生产价值
2.75万亿+
每月路由的Token数
### Ramp如何将内部工作负载的AI成本降低30%
Router实时响应延迟和故障率,在不影响性能的情况下将Ramp的AI成本降低了30%。
阅读博客文章 (https://builders.ramp.com/post/thompson-sampling-model-routing)
### NVIDIA NeMo Switchyard为编码智能体打造的阶段式路由器
Switchyard的智能模型选择在不影响性能的前提下,将成本降低59%,运行时间缩短35%。
观看视频 (https://cdn.air.inc/abdcb3e4-1e64-4703-9f84-01c95606790f)
“在Ramp,Router将我们的总LLM成本降低了30%,同时使我们的功能更智能、响应更快。”
Rahul Sengottuvelu
Ramp首席技术官
## 实验室更多研究
2026年7月1日
### PorTAL:面向LoRA的可移植任务适配 (https://labs.ramp.com/research/portal-portable-task-adaptation/)
一次学习以基础无关形式的任务适配,然后通过仅重新拟合每个基础的轻量级对齐层,将其移植到新的冻结模型——在同系列未见模型上可恢复约98%的每任务LoRA提升效果,跨系列则约为94%。
2026年4月21日
### 编码智能体忽视自身预算 (https://labs.ramp.com/research/coding-agents-ignore-spend/)
智能体无法被信任来管理自身的Token预算。支出控制必须置于执行支出的智能体之外的独立、基于证据的系统中。
2025年8月27日
### 我们如何构建Agent Fill (https://labs.ramp.com/research/how-we-built-agent-fill/)
Agent Fill背后的故事——一个通过理解上下文、提取数据并导航复杂工作流来自动填写表格的AI智能体。
## 常见问题
提供一个用于访问多个AI模型的端点。您无需将应用逐一接入某个提供商,只需通过我们的路由器发送请求,它就能根据质量、成本和可用性为任务选择合适的模型。无供应商锁定,一行代码即可切换。
是的。我们这样做了。因为除此之外,就得在播客里拼读一个更长的网址。更重要的是,我们构建的工具旨在帮助公司做出更好的支出决策,停止为事物多付钱。AI Token是增长最快的支出类别,我们希望您使用的每个Token都物有所值。
您的请求首先会发送到Ramp Router。我们会对请求进行身份验证,并帮助您追踪使用情况、模型、提供商和成本。当不会影响质量时,我们会将符合条件的请求路由到更具成本效益的层级。请参阅我们的路由器策略以节省更多。
Router支持来自OpenAI、Anthropic和其他提供商(包括Kimi)的最新模型,也包括部分开源模型。我们会在新模型可用时定期添加支持。在此处查看完整支持模型列表 (https://docs.router.com/supported-models)。
Ramp Router在2026年前免费。您只需按标准价格支付使用的Token费用。为纪念2026年前的免费路由,我们将赠送您26美元的初始积分。受优惠条款约束 (https://ramp.com/legal/developer-terms/developer-terms/router-terms-of-service)。
有,它们帮助证明了用户希望一个端点即可访问所有模型。
此处的不同之处:Ramp过去三年一直在自身生产工作负载上运行和改进这项技术,将客户的AI成本降低了40%。帮助企业节省时间和金钱是Ramp的宗旨,因此我们构建了Router,为开发者提供Ramp用于降低自身AI成本的工具。
通过路由器策略,开发者可以为不同类型的请求定义成本和性能优先级,或从Ramp经过基准测试的默认值开始。
Router在2026年前免费。您只需按标准价格支付使用的Token费用,并将获赠26美元的初始积分。受优惠条款约束 (https://ramp.com/legal/developer-terms/developer-terms/router-terms-of-service)。
直接对接将您的应用锁定在单一提供商的模型、定价和发布周期。而Router,您只需连接一次,即可通过单一端点使用所有符合条件的模型。
使用路由器策略来设置Router如何平衡不同类型请求的成本和性能,或从Ramp经过基准测试的默认值开始。参阅我们的策略文档以了解更多。
Router面向美国(更多国家/地区即将推出)的个人开发者和团队,旨在帮助您在不多付钱的前提下从AI中获得更多价值。无论您是独自验证想法还是为团队构建产品,Router都为您提供一个跨支持模型的工作平台。企业功能即将推出。
不需要。您无需Ramp卡、公司账户,甚至是有限责任公司。Router在2026年前免费。为庆祝此活动,我们将赠送您26美元的初始积分。在router.com输入您的电子邮件,我们将发送登录链接。开始使用仅需两行代码。
不需要。Ramp Router拥有兼容OpenAI和Anthropic的API,因此如果您已在使用OpenAI或Anthropic SDK或其他兼容框架(基本上是所有框架!),切换应只需一行代码:将您的基础URL更新为Ramp Router的端点。
请参阅Ramp Router隐私政策 (https://ramp.com/legal/privacy-terms/privacy-terms/router-privacy-notice)了解Ramp如何管理个人信息。
用户可选择使用提供零数据留存的美国托管模型。Router本身会存储模型输入、输出和元数据,并使用这些数据改进服务,但用户可控制部分设置。部分前沿模型具有提供商特定的数据留存策略——请在此处查看我们的条款 (https://ramp.com/legal/developer-terms/developer-terms/router-terms-of-service#6-third-party-providers-and-provider-terms)。
是的。Router支持为选定模型提供商使用自带API密钥。请参阅我们的技术文档了解更多详情。
Ramp Router使用由其基础模型提供商托管在美国基础设施上的模型。请参阅我们的技术文档了解更多详情。
如果某个提供商宕机或对您进行速率限制,Ramp Router可以将符合条件的请求路由到另一个可用模型,因此当一个提供商无法服务时,您的应用拥有回退方案。
是的。给予两个模型相同的提示,并排比较它们的响应、延迟和质量。这是在将某个模型集成到您的产品之前,快速测试模型的好方法。
## Token即金钱。两者皆需节省。
相似文章
Ramp 推出自己的 AI 模型路由器,名为 Router
Ramp 推出了 Router,这是一项 AI 模型路由服务,使公司能够通过 API 访问和切换各种大型语言模型,并具备成本优化和基于基准测试的路由功能。
Ramp Router 声称可将AI成本降低高达30%
Ramp 正在开源其内部 LLM 路由器,该路由器能根据每个请求自动选择最佳模型,以优化成本和性能。
Router by Ramp
Router by Ramp 是一款新产品,旨在通过帮助用户管理和减少 API 相关成本来节省 AI 代币使用费用。
@cursor_ai: 引入 Cursor Router,我们的智能模型路由器,可为当前任务选择合适的模型。Router 提供……
Cursor AI 推出了 Cursor Router,这是一个智能模型路由器,可为每个任务选择最佳模型,以降低 60% 的成本提供前沿质量的结果。
Cursor Router(2分钟阅读)
Cursor Router智能地为每项任务选择最佳AI模型,以降低60%的成本实现前沿质量的结果,适用于Teams和Enterprise计划。