Puppetmaster 将任意平台的 token 成本最多降低 98%
摘要
Puppetmaster 是一个开源超级编排器,可根据复杂度路由 AI 模型任务,声称通过利用持久状态架构并在查询中途切换免费层提供商,实现高达 98% 的成本降低。
Puppetmaster 是一个开源超级编排器,可根据复杂度路由模型任务。您可以调整可用的模型、路由到的平台等。Puppetmaster 利用独特的持久状态架构,而非转录历史记录。可以将其视为用于智能体群的 Redis + Gunicorn。无需再在群组中的智能体之间拉伸上下文。您可以在多个免费层提供商之间来回切换,无需支付一分钱。Puppetmaster 对目录进行图形化处理,并将速度提升高达 88%。随着您的上下文比探索同一代码库的标准子智能体群具有更深的关系深度,质量也会提高。
相似文章
质量差距不到2%但成本相差10倍:在相同的工具调用任务上测试5个模型[D]
一位开发者在工具调用任务上测试了五个AI模型,发现廉价模型的表现与Opus等昂贵模型相差不到2%,腾讯混元(Tencent's Hunyuan)成本低于1.50美元,而Opus为15美元,通过将简单任务路由到廉价模型,每日成本从40美元降至9美元。
@VaibhavSisinty:我刚刚发现了一个工具,能将AI代币成本降低95%,并且每月提供16亿免费代币。这是最……
OmniRoute 是 GitHub 上一个热门的工具,它通过压缩 AI 提示词,将代币使用量减少高达 95%,并通过无缝路由请求到多个提供商(如 Claude Code、Codex、Cursor、Cline 和 Copilot),每月提供 16 亿免费代币。
控制效应:编排设计如何设定企业代理型人工智能的代币经济
本文在“代币最大化”这一企业代理型人工智能概念中,通过对照实验证明:优化编排层(即“控制层”)可在保持质量的情况下,将代币成本降低38%、每任务成本降低41%,且效率提升与模型无关。
@rohanpaul_ai: TokenPilot 通过摄入感知压缩和生命周期感知驱逐来降低 LLM 智能体成本,实现了 61–87% 的成本降低。
TokenPilot 通过摄入感知压缩和生命周期感知驱逐来降低 LLM 智能体成本,在 PinchBench 和 Claw-Eval 上实现了 61–87% 的成本降低,且得分具备竞争力。
@DeRonin_: https://x.com/DeRonin_/status/2054235707791778034
一份实用指南,介绍了如何通过更智能的 Token 管理(包括多模型路由、提示词缓存和上下文纪律)来降低 80% 的 AI 编码成本,而不是简单地切换到更便宜的模型。