@adambcohen93: Weave 正在推出全球排名第一的提示路由器。它能让你的令牌使用效率提升70%……
摘要
Weave 推出一款提示路由器,可分析提示并将其路由到最具成本效益的模型,声称在不损失性能的情况下降低高达70%的成本。它与现有的工作流程(如 Claude、Cursor 和 Codex)集成,并且源代码可用。
查看缓存全文
缓存时间: 2026/05/21 06:24
Weave 正在推出全球排名第一的提示词路由器。它能让您将令牌使用效率提升 70%。
我们分析了数百万条提示词,发现绝大多数并不需要前沿模型。
Weave Router 解决了这个问题。它会分析您的提示词,并将其路由到成本最低的高质量模型(涵盖开源和闭源模型)。
这一切都在您当前的 Claude、Cursor 或 Codex 工作流中完成,因此您无需做任何改变。
早期客户已实现约 70% 的成本降低,且没有任何速度下降。
源代码已开放。
相似文章
Weave Router 2.0
Weave Router 2.0 是一款订阅感知型智能编码路由器,利用AI模型优化成本和性能,声称能以一半的价格达到GPT-6的水平。
@mckaywrigley:看好模型路由器。相同性能更低成本是显而易见的,但通过创建“更平滑”…
一条推文强调了模型路由器和“模型融合”的前景,提到Not Diamond Code的发布,这是一种面向编码智能体的智能模型路由器,可将成本降低20-65%。
Show HN: 在 Claude、Codex 和 Cursor 中直接进行智能模型路由
Workweave/router 是一款可直接在 Claude、Codex 和 Cursor 中实现智能模型路由的工具,能够高效选择 AI 模型。
@LangChain: OpenAI的提示缓存使请求成本降低90%,但缓存密钥的上限约为每秒15次请求。@HeggieCon…
OpenAI的提示缓存将请求成本降低了90%,但缓存密钥限制为每秒15次请求。Unify GTM构建了一个自定义路由解决方案来绕过这个限制,实现了95%的缓存命中率。
我开发了一个本地优先的 AI Agent 技能混合路由器(低于 20 毫秒、零 Token、纯 CPU 运行)[P]
Routed 是一款开源、本地优先的 AI Agent 技能混合路由器,纯 CPU 离线运行,结合稠密向量 Embedding、BM25 和精确匹配,可在 20 毫秒内完成提示词路由,无需任何 API 调用。该工具支持 Cursor、Claude Code、MCP 服务器等主流 Agent 环境,刚发布了 v1.1.0,新增多语言支持和 MCP 服务器模式。