我们如何防止44MB Excel文件炸毁AI代理的上下文窗口
摘要
本文介绍了为AI代理构建流式工具以处理大型Excel文件的方法,将上下文窗口使用量从8600万字符减少到一个小型JSON输出,并对比了OpenAI、Codex和Claude的解决方案。
典型问题:代理需要回答埋藏在巨大电子表格中的问题。将文件(或其文本导出)直接放入上下文不可行,在我们的案例中,一个超过100万行、44MB的工作簿作为纯文本将超过8600万字符。没有上下文窗口能承受这个量。解决方案:为代理提供一个窄接口而不是直接访问原始文件,就像你会查询数据库而不是导出整个表一样。构建了一个小型流式工具(使用Java + Apache POI + JBang),包含四个命令。教会代理先进行盘点,然后使用最窄的可用命令。结果:8600万字符 → 一个3,311字节的JSON回答,包含四行可引用的证据。还比较了OpenAI、Codex和Claude的harnesses如何处理相同问题。它们都趋于一致:将二进制文件排除在上下文之外,在文件旁确定性地解析,并向模型提供一个小的有界结果。完整的详细文章包含命令、JSON输出,以及在注释中讨论了过期公式/隐藏工作表的边缘情况。
相似文章
我构建了一种方法,防止巨大的工具输出撑爆AI代理的上下文窗口
LeanCTX已更新,作为管理AI代理工具输出的网关,压缩大数据,擦除秘密,并通过MCP集成外部工具,以防止令牌爆炸。
@rwayne: Context Mode 解决了 AI Agent 的另一半上下文问题:工具输出沙箱化 + 会话持久化。 56 KB 的 Playwright 快照压缩到 299 字节,98% 的数据不进上下文。每次文件编辑、Git 操作、任务决策都存入…
Context Mode is a tool that solves AI agent context problems by sandboxing tool outputs and persisting sessions, achieving up to 98% compression of Playwright snapshots and using BM25 retrieval to reduce context window usage. It supports 15 platforms including Claude Code, Gemini CLI, VS Code Copilot, and is used by major tech companies.
我是如何解决持续运行的Anthropic智能体循环中上下文窗口膨胀问题的(Opus + Sonnet架构)
一位开发者分享了一种架构模式,用于管理持续运行的Anthropic智能体循环中的上下文窗口膨胀问题,采用KV缓存、动态工具模式加载,以及通过Claude 3.5 Sonnet和Claude 3 Opus解耦执行器与顾问角色。
将AI代理的上下文削减66%,每年节省4000美元以上
一种新工具或技术承诺将AI代理的上下文使用量减少66%,每年可为用户节省超过4000美元的AI成本。
@_avichawla: https://x.com/_avichawla/status/2063548691353629040
阐述了传统后端如何增加AI代理的token使用量,并展示了一种上下文工程方法,该方法无需更改模型或提示词即可将Claude Code会话成本降低2.5倍。