token-cost

标签

Cards List
#token-cost

@a1zhang: 好的封装设计可以在信息结构化的前提下绕过极高的 token 成本。真的没必要每次都把……

X AI KOLs Following · 2026-06-15 缓存

讨论如何通过结构化信息而非将所有内容都输入语言模型的上下文来降低 token 成本,并以一个 RLM 代理处理大量日志行但只使用少量活跃 token 为例。

0 人收藏 0 人点赞
#token-cost

尝试使用这个工具,通过根据提示复杂度调整 Effort/Thinking 参数来降低 Claude 成本

Reddit r/openclaw · 2026-05-31

一个 GitHub 工具,通过根据提示复杂度动态调整 effort/thinking 参数来降低 Claude API 成本。

0 人收藏 0 人点赞
#token-cost

@vintcessun: 其实大模型上下文窗口越做越大,但成本也跟着飞涨。这篇论文干脆把上下文管理当成了部署优化问题来解,搞了个统一框架叫 Efficiency Frontier。 说白了,他们不再单独看性能或成本,而是联合建模任务表现、token 开销和预处理复…

X AI KOLs Timeline · 2026-05-26 缓存

这篇论文提出了一个名为 Efficiency Frontier 的统一框架,将大模型上下文管理视为部署优化问题,联合建模任务表现、token 开销和预处理复用。在 5000 个 HotpotQA 实例上,部署优化可节省 25% 的 token 量,而记忆压缩在高精度场景下比全上下文便宜一半以上。

0 人收藏 0 人点赞
#token-cost

@nateherk: https://x.com/nateherk/status/2057450555212013627

X AI KOLs Timeline · 2026-05-21 缓存

一份实用指南,解释Claude Code中的提示缓存工作原理,如何将Token成本降低90%,以及常见的破坏缓存的习惯,帮助开发者延长会话时长并降低成本。

0 人收藏 0 人点赞
#token-cost

OpenSquilla 发布开源 AI 代理以降低 Token 成本(4 分钟阅读)

TLDR AI · 2026-05-15 缓存

OpenSquilla 推出了一款开源 AI 代理运行时,通过智能路由、缓存和四层记忆架构来降低 Token 成本,声称可节省 60-80% 的费用。

0 人收藏 0 人点赞
← Previous
← 返回首页

提交意见反馈