标签
本文探讨了多智能体AI工作流中用于提高效率和性能的Token优化和上下文窗口管理技术。
Anthropic published a practical guide for Claude Code, emphasizing context management through session commands and discussing token optimization and prompt caching to improve efficiency in AI-assisted coding.
Anthropic发布了如何通过在提示缓存过期之前使用/compact命令来高效运行Claude Code的说明,以节省token。
mcptoon 是一个零依赖的 Python CLI 客户端,用于 MCP 服务器。它采用紧凑的 TOON 格式,将工具发现的 token 消耗减少高达 97%,从而为 AI 代理节省上下文窗口空间。
Addy Osmani 分享了一个技巧:定期在 Claude Code 中运行 /doctor,或让 Codex 审计未使用的技能、MCP 和上下文使用情况,以减少 token 膨胀。
一位开发者分享了通过精简系统提示、收紧检索、裁剪工具输出等技术,将AI Agent的令牌消耗降低72%的详细案例研究,且对成功率影响极小。
作者认为,AI编码工具链和模型路由与模型本身同样重要,分享了使用Oh-My-Pi和OpenCode进行的测试,这些测试减少了token使用量和错误,并推荐针对高容量、轻量级任务采用分层模型订阅。
Book-to-skill 是一个开源工具,可将技术书籍转换为供 AI 编码智能体使用的结构化技能,通过按需仅加载所需章节,将 token 使用量减少 24 倍至 51 倍。
Vercel工程师总结出的AGENTS.md,能帮你在项目开发中省下80%的token,核心是通过工程化的决策和方案设计,降低AI的无效迭代和token消耗。
一位开发者分享了一个精心整理的安装程序,其中打包了11个Token优化工具,帮助AI代理管理上下文并减少Token使用量,同时向社区征求额外建议,特别是针对多代理设置。
Webcmd 是一个开源工具,它教会浏览器代理一次性学习网站导航并重复使用,从而大幅减少重复任务中的token浪费。它支持99个网站,并可在本地运行。
作者描述了如何通过多个订阅和更便宜的模型构建自定义AI研究管线以降低代币成本,并在研究代币经济学的过程中亲身体验了如何优化代币使用。
An engineer tracked his coding agent's token usage over a week, finding that only 0.67% of tokens were spent on actual tasks, with 99% consumed by tool directories, skill descriptions, and system prompts. He provides optimization strategies, including shell output filtering which saved 46.9% of tokens.
pxpipe是一个本地开源代理工具,通过将大量文本(如系统提示、代码、日志)渲染为PNG图片并输入大模型的视觉通道,利用图片按像素计费而非按字数计费的特点,成功将Claude Code的账单降低约70%。该工具完美适配Fable 5模型,原理巧妙且全自动化,但属于有损压缩,不适合敏感数据。
Boost是一个惰性加载的本地CLI层,它截断冗长的终端输出,并用语义标记替换以减少编码代理的令牌消耗,同时将日志本地缓存以供按需检查。该工具在JFrog内部孵化,完全在本地运行,并寻求社区对其启发式方法的反馈。
一位开发者声称,通过提供一个包含Anthropic秘密文档的Markdown文件,该系统在Claude Code中节省了95%的代币,使AI代理精准度提升,生产力提高了10倍。
ClaudeDevs 分享了使用 Fable 5 作为顾问的模式,由执行器 Sonnet 5 调用以利用更低的计费价格节省 Token 成本。
一款名为Context Mode的免费GitHub插件通过将工具调用隔离在沙箱中,仅返回必要的输出,从而将Claude Code的token浪费减少高达98%,同时保存会话状态,让Claude能够从断点继续执行。
pxpipe 是一个本地代理,通过将庞大的上下文(系统提示、工具文档、历史记录)转换为紧凑的图像来减少 Claude Code 的令牌使用量,实现了 59-70% 的成本节省,且准确性损失最小。它利用了图像相对于文本在密集内容上的令牌效率。
Superpowers 6.0发布,通过Fable 5优化实现速度提升50%,Token消耗减少60%,保持同等高质量输出。