@a1zhang: 好的封装设计可以在信息结构化的前提下绕过极高的 token 成本。真的没必要每次都把……
摘要
讨论如何通过结构化信息而非将所有内容都输入语言模型的上下文来降低 token 成本,并以一个 RLM 代理处理大量日志行但只使用少量活跃 token 为例。
查看缓存全文
缓存时间: 2026/06/15 23:08
优秀的数据管道设计能够在信息结构化的前提下规避极端令牌成本。实际上,我们完全无需将所有内容一股脑塞进语言模型的上下文。
很长一段时间里,我们错误地将这种“野蛮投喂”的做法与「苦涩教训」式的规模扩展混为一谈。一个好用的数据管道设计能发挥巨大作用!
diego 🧞♂️ (@diblacksmith): 我的 RLM agent 可以轻松一次性处理约 8 万行来自 CloudWatch 的服务日志
这相当于 800 万令牌的价值。
最酷的是,在 53 步之后,它只花费了 3.2 万“活跃“令牌*(此时尚未完整处理全部 800 万,大约完成了一半)。
这点开销根本不算什么。
相似文章
最好的智能代理工具会这样做……
作者分享了构建高效智能代理工具的见解:最好的工具最大限度地减少对大语言模型(LLM)在琐碎任务上的依赖,将其保留用于复杂推理,从而将真正的代理工具与简单的包装器区分开来。
控制效应:编排设计如何设定企业代理型人工智能的代币经济
本文在“代币最大化”这一企业代理型人工智能概念中,通过对照实验证明:优化编排层(即“控制层”)可在保持质量的情况下,将代币成本降低38%、每任务成本降低41%,且效率提升与模型无关。
@omarsar0:强烈推荐。我经常声称构建agent harnesses有巨大的alpha收益。结果发现harnesses是组合…
讨论了agent harnesses作为组合通用器的概念,用于模型中扩展泛化能力,并引用了RLM harness。
@rajistics: 代币成本正在攀升。如何避免被单一供应商的 harness 锁定?做了一个演示,展示 @OpenH…
一个演示,展示 OpenHands 如何作为控制平面,跨多个 agent harness(如 Claude Code、Gemini CLI 和 OpenHands 自身)工作,使得无需重写编排即可交换模型或供应商。
@omarsar0: // Scaling Laws for Agent Harnesses // 如果你构建代理框架,这篇文章值得一看。(收藏)大多数 harness…
关于代理框架缩放定律的新研究显示,大多数字令和工具调用次数并不重要;该研究引入了一种有效的方法。