token-optimization

标签

Cards List
#token-optimization

多智能体AI工作流中的Token优化与上下文窗口管理

arXiv cs.CL ↗ · 2026-08-19 缓存

本文探讨了多智能体AI工作流中用于提高效率和性能的Token优化和上下文窗口管理技术。

0 人收藏 0 人点赞
#token-optimization

@Xudong07452910: Anthropic 刚写了一篇很实用的 Claude Code 使用指南。 里面有个细节我之前没有太认真想过: Claude 读过的文件、跑过的测试、终端输出,一旦进入当前 Session,后面每一轮基本都会继续带着它们。 所以一个 Cl…

X AI KOLs Timeline ↗ · 2026-08-16 缓存

Anthropic published a practical guide for Claude Code, emphasizing context management through session commands and discussing token optimization and prompt caching to improve efficiency in AI-assisted coding.

0 人收藏 0 人点赞
#token-optimization

@Saboo_Shubham_: Anthropic刚发布了如何运行Claude Code而不浪费token。你的提示缓存一小时后过期。运行/c…

X AI KOLs Timeline ↗ · 2026-08-15 缓存

Anthropic发布了如何通过在提示缓存过期之前使用/compact命令来高效运行Claude Code的说明,以节省token。

0 人收藏 0 人点赞
#token-optimization

Show HN:Mcptoon – 将工具发现 token 消耗降低 97% 的 MCP CLI 客户端

Hacker News Top ↗ · 2026-08-11 缓存

mcptoon 是一个零依赖的 Python CLI 客户端,用于 MCP 服务器。它采用紧凑的 TOON 格式,将工具发现的 token 消耗减少高达 97%,从而为 AI 代理节省上下文窗口空间。

0 人收藏 0 人点赞
#token-optimization

@addyosmani:提示:定期在 Claude Code 中运行 /doctor,或让 Codex 审计未使用的技能、MCP 和上下文使用情况。你可能已…

X AI KOLs Timeline ↗ · 2026-08-10 缓存

Addy Osmani 分享了一个技巧:定期在 Claude Code 中运行 /doctor,或让 Codex 审计未使用的技能、MCP 和上下文使用情况,以减少 token 膨胀。

0 人收藏 0 人点赞
#token-optimization

将我的Agent令牌消耗削减72%(每个任务11.9k ➝ 3.3k)。以下是我所做的具体改动,附数据

Reddit r/AI_Agents ↗ · 2026-08-10

一位开发者分享了通过精简系统提示、收紧检索、裁剪工具输出等技术,将AI Agent的令牌消耗降低72%的详细案例研究,且对成功率影响极小。

0 人收藏 0 人点赞
#token-optimization

同一AI模型。更好的结果。更低的成本。

Reddit r/AI_Agents ↗ · 2026-08-07

作者认为,AI编码工具链和模型路由与模型本身同样重要,分享了使用Oh-My-Pi和OpenCode进行的测试,这些测试减少了token使用量和错误,并推荐针对高容量、轻量级任务采用分层模型订阅。

0 人收藏 0 人点赞
#token-optimization

@alex_verem: 每次你向智能体询问一本你已经拥有的书时,你都在烧掉 20 万 token。把一本 400 页的技术书…

X AI KOLs Timeline ↗ · 2026-08-05 缓存

Book-to-skill 是一个开源工具,可将技术书籍转换为供 AI 编码智能体使用的结构化技能,通过按需仅加载所需章节,将 token 使用量减少 24 倍至 51 倍。

0 人收藏 0 人点赞
#token-optimization

@Saccc_c: Vercel工程师总结出的AGENTS.md,能帮你在项目开发中省下80%的token 核心是通过工程化的决策和方案设计,降低AI的无效迭代和token消耗 完整版如下,建议配置在你的项目文件夹下: # AGENTS.md - 不以维护向…

X AI KOLs Following ↗ · 2026-08-03 缓存

Vercel工程师总结出的AGENTS.md,能帮你在项目开发中省下80%的token,核心是通过工程化的决策和方案设计,降低AI的无效迭代和token消耗。

0 人收藏 0 人点赞
#token-optimization

精选11个Token优化工具整合到一个安装程序中——我还漏掉了什么?

Reddit r/AI_Agents ↗ · 2026-07-24

一位开发者分享了一个精心整理的安装程序,其中打包了11个Token优化工具,帮助AI代理管理上下文并减少Token使用量,同时向社区征求额外建议,特别是针对多代理设置。

0 人收藏 0 人点赞
#token-optimization

@heyshrutimishra: 运行浏览器代理最昂贵的部分不是任务本身,而是任务之前的一切。导航、查找…

X AI KOLs Timeline ↗ · 2026-07-24 缓存

Webcmd 是一个开源工具,它教会浏览器代理一次性学习网站导航并重复使用,从而大幅减少重复任务中的token浪费。它支持99个网站,并可在本地运行。

0 人收藏 0 人点赞
#token-optimization

我消耗了所有代币来研究如何节省代币

Hacker News Top ↗ · 2026-07-19 缓存

作者描述了如何通过多个订阅和更便宜的模型构建自定义AI研究管线以降低代币成本,并在研究代币经济学的过程中亲身体验了如何优化代币使用。

0 人收藏 0 人点赞
#token-optimization

@yibie: 推荐这篇硬核实测。一个工程师用了一周追踪自己的 coding agent session,发现任务本身只消耗了 0.67% 的 token——其余 99% 全花在搬运工具目录、skill 描述和系统 prompt 上。工作对开销比 1:1…

X AI KOLs Timeline ↗ · 2026-07-15 缓存

An engineer tracked his coding agent's token usage over a week, finding that only 0.67% of tokens were spent on actual tasks, with 99% consumed by tool directories, skill descriptions, and system prompts. He provides optimization strategies, including shell output filtering which saved 46.9% of tokens.

0 人收藏 0 人点赞
#token-optimization

@CycleDecoded: 离谱了兄弟们,GitHub 刚冲上趋势的一个骚操作,直接把大模型计费系统给“卡BUG”了。 这玩意叫 pxpipe(MIT协议),是一个专治 Claude Code 账单刺客的本地开源代理工具。原理简直绝了:大模型按字数算文本 Token…

X AI KOLs Timeline ↗ · 2026-07-10 缓存

pxpipe是一个本地开源代理工具,通过将大量文本(如系统提示、代码、日志)渲染为PNG图片并输入大模型的视觉通道,利用图片按像素计费而非按字数计费的特点,成功将Claude Code的账单降低约70%。该工具完美适配Fable 5模型,原理巧妙且全自动化,但属于有损压缩,不适合敏感数据。

0 人收藏 0 人点赞
#token-optimization

通过惰性加载本地CLI层剥离代理上下文中的终端噪声。寻求对此启发式方法的严厉反馈。

Reddit r/LocalLLaMA ↗ · 2026-07-09

Boost是一个惰性加载的本地CLI层,它截断冗长的终端输出,并用语义标记替换以减少编码代理的令牌消耗,同时将日志本地缓存以供按需检查。该工具在JFrog内部孵化,完全在本地运行,并寻求社区对其启发式方法的反馈。

0 人收藏 0 人点赞
#token-optimization

@noisyb0y1: 年收入140万美元的Claude Code开发者展示了节省95%代币的系统:将一个MD文件放入Claude Code——然后……

X AI KOLs Timeline ↗ · 2026-07-09 缓存

一位开发者声称,通过提供一个包含Anthropic秘密文档的Markdown文件,该系统在Claude Code中节省了95%的代币,使AI代理精准度提升,生产力提高了10倍。

0 人收藏 0 人点赞
#token-optimization

@FinanceYF5: ClaudeDevs 分享了他们在使用 Fable 5 时经常采用的几种模式: 把 Fable 5 当成“顾问”。 由执行器 Sonnet 5 调用 Fable 5 获取指导。 这样,大部分 Token 都会按照更低的执行器价格计费。

X AI KOLs Following ↗ · 2026-07-09 缓存

ClaudeDevs 分享了使用 Fable 5 作为顾问的模式,由执行器 Sonnet 5 调用以利用更低的计费价格节省 Token 成本。

0 人收藏 0 人点赞
#token-optimization

@PrajwalTomar_: 您每次Claude Code会话都在浪费数千token。安装了免费插件的人却没有。原因…

X AI KOLs Following ↗ · 2026-07-07 缓存

一款名为Context Mode的免费GitHub插件通过将工具调用隔离在沙箱中,仅返回必要的输出,从而将Claude Code的token浪费减少高达98%,同时保存会话状态,让Claude能够从断点继续执行。

0 人收藏 0 人点赞
#token-optimization

@paul_cal: 他们自己确实尝试了一些东西。没有审计过,但很容易让一个代理指向仓库并扩展...

X AI KOLs Following ↗ · 2026-07-05 缓存

pxpipe 是一个本地代理,通过将庞大的上下文(系统提示、工具文档、历史记录)转换为紧凑的图像来减少 Claude Code 的令牌使用量,实现了 59-70% 的成本节省,且准确性损失最小。它利用了图像相对于文本在密集内容上的令牌效率。

0 人收藏 0 人点赞
#token-optimization

@Gorden_Sun: Superpowers 6.0版本发版:Fable 5加成 Superpowers是一套技能和指令组合,遵循完整的软件开发方法论,适用于CC、Codex等各种Agent。 6.0版本经过Fable 5优化,运行速度大幅提升50%,并且消耗…

X AI KOLs Timeline ↗ · 2026-07-04 缓存

Superpowers 6.0发布,通过Fable 5优化实现速度提升50%,Token消耗减少60%,保持同等高质量输出。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈