@svpino: 如果这能像承诺的那样工作,那将是巨大的!在你的代码中将 "model='your-favorite-model'" 替换为 "model='ship-like/your-favorite-model'" …
摘要
Martian 宣布推出 Ship,这是一个 API 端点,承诺通过智能路由将 Opus 和 GPT 等前沿模型的成本降低 50%,同时保证相同的功能和行为。
查看缓存全文
缓存时间: 2026/07/21 22:51
如果这个功能真如承诺的那样,那可太棒了!
只需将代码中的 model='your-favorite-model' 替换为 model='ship-like/your-favorite-model'。
无需改动其他任何内容,即可获得三重保障:
- 比直接连接模型节省 50% 的费用
- 享受 100% 相同的功能
- 享受 100% 相同的行为
据称,他们通过某种“智能路由”在后台实现这一点。
收到请求后,他们可以确定:
- 花费多少计算资源
- 使用哪个模型(或模型组合)
- 使用哪些工具、封装、集成方案等
- 采用哪种执行方式
我猜测这里的权衡是调用模型时会增加额外延迟,但考虑到成本降低 50%,对大多数人来说显然是个划算的选择。
Martian(@withmartian): 宣布 Ship:一个每美元智能算力最高、超越所有前沿模型的端点。
如今,Ship 保证通过服务质量协议(SLA)让使用 Opus 和 GPT 5.6 Sol 的成本降低 50%。
相似文章
@akshay_pachaar: 只需改动一行代码,即可将Claude推理成本降低50%! - 删除 → model="claude-opus-4-8" - 添加 → model="ship-…"
Ship 宣布推出一款端点,通过动态选择最便宜的执行路径,同时保持参考模型的质量,从而确保 Claude 推理成本降低 50%,并将成本波动从应用中消除。
@MTSlive: 情况说明:前沿模型70%的查询可在本地免费运行。@ClementDelangue,联合创始人兼首席执行官…
Hugging Face的Clement Delangue解释称,像ChatGPT这样的前沿模型,70%的查询可在本地免费处理,并认为将查询路由到专门的模型,会把价值从大型模型重新分配给更小、更高效的长尾模型。
@alexatallah: 如果你是一位研究人员,希望→开展严谨的研究,探讨多个模型如何超越前沿→利…
OpenRouter 推出 Fusion API,这是一种复合模型,能以一半的价格实现高智能,利用了最大的 LLM 市场。
Launch HN: Tokenless (YC S26) – 自动切换模型以节省成本
Tokenless 是一家获得 YC 支持的初创公司,提供 LLM API 调用的即插即用替代方案,自动将请求路由到最具成本效益的模型,而不牺牲质量,有望将推理成本降低一半。
@hooeem: https://x.com/hooeem/status/2062266452921491934
一份指南,解释如何通过将固定流程编译成更小的微调模型,而不是反复提示前沿模型,从而使代理工作流成本降低高达462倍。