Show HN: Frugal Tokens – 探索编程代理中的成本与使用情况
摘要
Frugal Tokens 是一款用于分析与AI模型的编程会话中的成本和使用模式的工具,帮助开发者理解和优化他们的支出。
我想分享一个我一直在开发的项目,名为 Frugal Tokens。我最初构建它是因为我好奇想看看我所有的会话花费了多少,以及缓存未命中对支出有多大影响。我注意到人们的支出模式差异很大,想更好地理解是什么原因导致了这种情况。<p>随着我对此的开发,这个工具已经扩展到显示您所有会话的更多使用模式。它显示总体使用情况、估计工作时间和重叠会话,以及您的支出来自哪些模型和缓存未命中。我还提供了一些会话级别的指标,包括百分位数分解,以及您的会话列表和高层信息。<p>点击一个会话会打开一个浏览器,您可以在其中查看各个模型调用和工具的输入输出。您还可以直接跳转到缓存未发生的地方。还有一个粗略的成本比较,显示使用另一个模型的定价,或者对于 Anthropic,使用 5 分钟 vs 1 小时缓存,记录的会话将会花费多少。<p>未来,我希望能收集更多信息,以了解哪些模式可能会使人们的工作流程更昂贵,例如长会话、高上下文使用、多次轮换等。<p>这个工具需要 deno,但一旦安装后,只需一条命令即可运行。提供的演示中有一些数据被擦除,但有助于在运行之前展示其外观。<p>欢迎提出任何想法或建议<p><a href="https://github.com/dpclark4/frugal-tokens" rel="nofollow">https://github.com/dpclark4/frugal-tokens</a>
相似文章
@ClementDelangue:令牌成本决定了不会有SaaS末日——优秀的开发工具是代理的缓存智能!流行的观…
Hugging Face的hf CLI被证明远比手写原始API调用更高效、更成功,AI代理使用后基准测试显示令牌消耗减少多达6倍,任务成功率从84%提升至94%,这表明良好的抽象是代理的缓存智能。
子代理在长代理运行中占据大部分Token成本:实际可将使用量降低70%至90%的修复方法
本文分析了 Bai 等人 2026 年的论文,该论文表明,子代理和上下文膨胀导致长代理运行中的Token成本比普通聊天高出约1000倍,并提出了三种实用的修复方法(PLAN.md、读取预算、带外备注),可将Token使用量减少70-90%。
我消耗了所有代币来研究如何节省代币
作者描述了如何通过多个订阅和更便宜的模型构建自定义AI研究管线以降低代币成本,并在研究代币经济学的过程中亲身体验了如何优化代币使用。
编程代理是否变得昂贵,还是我们对成本的衡量方式有误?
本文质疑编程代理的真实成本是否包含隐藏的人力监督和调试,认为真正的价值应以可信输出来衡量,而非原始 token 消耗。
追踪每次提示的令牌使用量
作者创建了一个开源CLI工具,可实时监控AI代理每次提示的令牌使用量和API成本,并寻求有兴趣的人分享。