标签
ANOLISA是一个用于AI智能体工作负载的智能体操作系统层,其特点包括通过AgentSight实现基于eBPF的可观测性、令牌优化以及无需代码更改的运行时管理。
本指南提供了一种逐步方法,使用Claude Code配合OpenAI Codex插件和涉及GPT-5.6变体的三模型工作流程,以将令牌消耗减少至少60%并避免使用限制。
Claude Code 引入了 Concise 输出风格,通过减少冗长回复来节省 Token,使交互更快、更高效,同时保留关键细节。
Browser Use 推广 Hermes 代理与云浏览器,用于隐身浏览,提供 15 美元免费额度(价格为 0.02 美元/小时),并强调 Browser-Use CLI 3.0 的后端可将 token 消耗降低 60%。
本文分享一个针对 Codex 5.6 的隐藏提示词,让 AI 在接受任务前先审查需求中的错误前提、逻辑漏洞和风险,从而减少返工并节省 token。
推荐一个开源项目caveman,通过让AI用原始人语法回复来减少输出token,可节省65%的散文token和8.5%的代理编码任务token,兼容30多种AI代理工具。
Ray Fernando 分享了一个更高效运行 Codex agents 的工作流技巧,声称它能避免杂乱输出并节省 token,而且顶尖 FANG 公司的工程师们都在使用。
分享了一个在Codex中快速获取上下文并节省token的技巧:当会话上下文快满时,开新会话并引用旧会话总结核心信息,继续任务执行。
本文讨论了一个产品的beta测试,该产品提供1000次免费Recalls和高达150倍的token成本降低,具有可无限扩展的Memory Banks,可在不同会话和模型中使用。
Agentmap 是一个开源工具,可爬取任何网站并将其转换为页面、流程和数据的结构化地图,使编码代理(如 Claude Code、Cursor)跳过盲目探索,直接执行任务,节省令牌。
使用Fable和Opus等AI编码工具的实用技巧:让它们自行判断而不是规定行为,并通过子代理将较小的任务委托给较低功耗的模型,以节省token并提高效率。
cocoindex-code 是一个基于 AST 的语义代码搜索工具,可以快速集成到编码代理中,节省高达 70% 的 token 并提高搜索效率。
一位开发者创建了一个统一的安装程序,将现有的如 OpenSpec、RTK 和 ccusage 等为 Copilot 和 Claude Code 节省 Token 的工具整合在一起,并带有命令行界面,可显示实际的 Token 消耗节省量。
为DeepSeek V4 Pro优化的Codex技能,通过冻结skill文件和极简输出可节省60-80% token,并提供跨对话持久记忆功能。
curl.md is an open-source tool that converts web pages to optimized Markdown format for AI agents, significantly reducing token consumption and cost. It offers CLI, browser extension, and API usage, with integrations for Cursor, Claude, and other agents.
介绍一个 TypeScript 命令行工具 Repo-to-Agent-Context,它能把任意代码仓库压缩成 AI 编程 Agent 可读的结构化上下文包,节省 token 并避免上下文丢失。
一个开源项目通过Tree-sitter将代码解析成图结构并存入本地SQLite,为AI coding agent提供代码地图,从而减少token消耗和成本,平均节省57% token,成本降低25%。支持Claude Code、Cursor、aider等工具。
Lowfat是一个轻量级的CLI过滤器,通过在被代理工具接收前剔除不必要的输出来降低AI令牌成本,声称可节省高达91.8%的令牌。它提供Shell集成、插件支持,以及针对Claude Code和OpenCode等工具的透明重写功能。
rtk 库通过压缩 shell 命令输出来减少 token 消耗,在两周内为编码代理节省了 250 万个 token。
介绍 watchmen,一个开源本地工具,它能从用户会话中为编码代理(Claude Code、Codex、pi)编写技能文件,通过避免重复解释已学行为来降低 token 成本。