@alex_prompter: 我的智能体每次我给它们更多工具时,它们都变得更笨了。原因是机械性的。你连接的每个 MCP 服务器…
摘要
Ratel 是一个开源工具,通过使用 BM25 索引仅加载所需的工具(而不是所有可用工具),将输入令牌减少 79%,并提高了 AI 智能体的工具选择准确性。
查看缓存全文
缓存时间: 2026/07/22 08:28
每次我给智能体添加更多工具,它们反而变得更笨了。
原因很机械。
你连接的每个MCP服务器每轮都会把完整工具列表塞进上下文,正确的工具最终被埋在一百条模型永远不会用到的描述里。
Ratel则反过来:它位于智能体和工具目录之间,只加载当前轮次所需的工具。
无需嵌入向量,无需向量数据库,仅用进程内的纯BM25索引。
他们的基准测试:在180个工具的情况下,Sonnet的输入token减少79%。
本地模型的工具选择准确率从8%跃升至77%。
代码库已开源。
当前智能体的主要问题在于上下文,而非能力。
Ratel (@ratelai): 我们刚刚让智能体运行成本降低7倍
今天我们发布了Ratel
现在你的智能体会加载你拥有的所有工具和技能来完成一个小任务 Ratel只加载该任务所需的部分
看看它是如何工作的 ↓
相似文章
@ryanlanciaux: "他们会安装MCP服务器,让智能体能访问更多工具。" "它怎么知道什么时候该用这个工具?" "没人知道…"
一条推文讨论了AI智能体如何利用MCP服务器访问工具,并提出疑问:它们怎么知道何时使用这些工具?并坦言没人知道答案。
@akshay_pachaar: https://x.com/akshay_pachaar/status/2053166970166772052
The article discusses a shift in AI agent tool usage from the 'MCP vs CLI' debate to 'Code Mode,' where agents write code to dynamically import tools, significantly reducing context window usage. It highlights Anthropic's approach and Cloudflare's implementation, demonstrating a 98.7% reduction in token consumption for specific tasks.
利用智能体编写高效的工具——借助智能体本身
Anthropic 分享了为 AI 智能体设计、评估和优化工具的工程最佳实践,特别介绍了如何利用模型上下文协议(MCP)和 Claude Code 来提升智能体的性能。
@HowToAI_: 现在只需一条命令,您就能将 Claude Code 的工具调用次数削减94%。这个 MCP 服务器将您的代码库索引到…
一个新的 MCP 服务器通过将代码库索引到本地知识图谱中,将 Claude Code 的工具调用减少94%,使代理能够查询图谱而不是扫描文件。
@hasantoxr: 所以我发现了一个GitHub仓库,它可以阻止AI代理无谓地消耗token。它叫Headroom。它是由一位……
Headroom是Netflix的Tejas Chopra开发的一个GitHub工具,它能在将输入(工具输出、日志、RAG块等)发送给LLM之前进行压缩,承诺在不改变答案的前提下减少60–95%的token。它支持Python/TypeScript库、本地代理、MCP服务器,以及针对流行编程代理的封装器。