@AYi_AInotes: Damn,这个开源工具直接减少了95%token消耗 这可能是今年最狠的LLM降本神器, Netflix工程师开源的Headroom 把本地Agent套在Codex,Cursor,OpenClaw,Hermes或Claude code外面…
摘要
Netflix工程师开源了Headroom工具,在本地预处理阶段自动压缩LLM输入上下文,减少高达95%的token消耗,兼容Codex、Cursor等主流AI编码工具,无需修改代码即可生效。
查看缓存全文
缓存时间: 2026/06/22 07:40
Damn,这个开源工具直接减少了95%token消耗 这可能是今年最狠的LLM降本神器,
Netflix工程师开源的Headroom 把本地Agent套在Codex,Cursor,OpenClaw,Hermes或Claude code外面,数据进模型前自动压缩负载, 不用改任何代码,就能直接生效,
核心能力四个点 智能压缩日志 JSON和代码 完美保留逻辑准确性, 全程100%数据本地化 内容不会流出本地环境, 避免顶级模型在样板代码上浪费大量令牌, 适配主流AI编码工具 开箱即用,
上线没多久就拿下35k GitHub星标 行业认可度拉满,
说白了,以前你喂给 Claude code Codex的一大坨上下文里,有一半以上是冗余的, Headroom 在本地帮你剃干净了再发过去,LLM 收到的全是精肉。
本质上是把降本的逻辑从改提示词换模型挪到了输入前置处理, 不牺牲效果也不碰数据安全 是目前最稳妥的降本思路之一,
完全免费开源 仓库链接放评论区了 有需要的直接冲
相似文章
@GitTrend0x: AI Agent Token 压缩 60-95% 开源神器 https://github.com/chopratejas/headroom… 这就是 Headroom,6.7k star LLM Token 终极压缩神器!一句话干翻所有 …
Headroom 是一个开源工具,可将 AI Agent 读取的工具输出、日志、RAG 片段等压缩 60-95%,同时保持答案质量不变,支持可逆压缩和跨 Agent 共享记忆。
@nini_incrypto_: Headroom,把大模型 Token 成本砍掉 95% ! 1. 真·零代码更改:提供 Proxy 代理模式,任何编程语言只需改个端口就能直接无缝接入。 2. 全吞吐压缩:自动压缩工具输出、运行日志、RAG 知识库切片以及密密麻麻的聊天…
Headroom 是一个上下文压缩层,可以将 AI agent 读取的 Token 成本降低 60-95%,支持零代码更改的代理模式,且不降低模型回答质量。
@tonysimons_: 一位Netflix工程师构建了一个开源代理,可将AI token使用量减少60-95%。零代码更改。基准测试显示±0…
一位Netflix工程师构建了Headroom,这是一个开源代理,可在无需代码更改且精度损失可忽略的情况下,将LLM上下文压缩60-95%。它支持主要AI代理,并在GitHub上以Apache 2.0许可提供。
@DataChaz: 最高减少95%的令牌消耗,无需修改代码 一位Netflix工程师刚刚开源了Headroom,这是……
Headroom是来自Netflix工程师的开源工具,它在本地代理中封装Cursor或Claude以压缩有效负载,无需修改代码即可将令牌使用量减少高达95%,同时保持逻辑准确性。
@hasantoxr: 所以我发现了一个GitHub仓库,它可以阻止AI代理无谓地消耗token。它叫Headroom。它是由一位……
Headroom是Netflix的Tejas Chopra开发的一个GitHub工具,它能在将输入(工具输出、日志、RAG块等)发送给LLM之前进行压缩,承诺在不改变答案的前提下减少60–95%的token。它支持Python/TypeScript库、本地代理、MCP服务器,以及针对流行编程代理的封装器。