@DeRonin_: 我实际如何在模型之间路由:推文草稿:Sonnet 4.6 长篇文章:Opus 4.6 代码工作:Kimi 2.6 代理…
摘要
一位用户分享了他们在不同任务(如推文草稿、文章、代码、代理循环和图像生成)之间使用各种AI模型的个人路由策略,并认为单一模型配置会导致更高成本。
我实际如何在模型之间路由:推文草稿:Sonnet 4.6 长篇文章:Opus 4.6 代码工作:Kimi 2.6 代理循环:Kimi 2.6 KOL研究:Grok 4.3 快速事实:Perplexity Pro 图像生成:GPT-Image-2 语音一致性:Sonnet 4.6 模板代码:Qwen 3 本地 是的,单一模型配置正是你的AI账单比我贵10倍的原因。
相似文章
@DeRonin_: 我跑了一整天Fable 5,却还没触及我的极限,为什么?因为我在这里停止了为闲聊支付高昂的费用……
一位用户分享了一种高效使用多个AI模型(Fable、Opus、Codex、DeepSeek、GLM、Qwen、Kimi)的详细工作流策略,通过根据成本和能力委派任务、使用单个CLAUDE.md路由表、以及避免闲聊来减少token使用。
@DeRonin_: https://x.com/DeRonin_/status/2054235707791778034
一份实用指南,介绍了如何通过更智能的 Token 管理(包括多模型路由、提示词缓存和上下文纪律)来降低 80% 的 AI 编码成本,而不是简单地切换到更便宜的模型。
最佳模型路由因任务而异(6分钟阅读)
模型路由是降低推理成本的热门趋势,但最佳路由高度依赖具体任务。Harvey和Factory等团队通过专注于单一工作流而非通用路由器,实现了显著的成本节约。
@julien_c: 模型路由是多模型堆栈中缺失的一层。开源模型在编码方面不断进步,路由帮助它们…
Not Diamond Code 是一款面向长期编码代理的智能模型路由器,为每一步选择最佳模型和推理努力,可将成本降低 20-65%。
模型路由的第一性原理
本文概述了有效AI模型路由的第一性原理,强调保持模型差异化、限制池大小、使用相对实际基准以及评估过去的路由决策以实现更好的性能。