token-optimization

标签

Cards List
#token-optimization

我正在测试一个OpenClaw插件,该插件旨在减少浪费的代理运行。寻找几位真实世界的测试者。

Reddit r/openclaw ↗ · 17小时前

Xybernetex是一个实验性的OpenClaw插件,通过监控AI代理运行来减少浪费的令牌并提高任务成功率,采用重试和验证等干预措施,作者正在寻求真实世界的测试者。

0 人收藏 0 人点赞
#token-optimization

Basis 通过 GPT-6 Astra 将税务工作簿完成速度提升两倍

OpenAI Blog ↗ · 昨天 缓存

Basis 表示,利用 GPT-6 Astra 不仅将复杂税务工作簿的完成速度提升了一倍,还增强了其AI代理在会计任务中的效率与决策水平。

0 人收藏 0 人点赞
#token-optimization

使用确定性图像路由减少88%的令牌消耗(P50:59毫秒)[P]

Reddit r/MachineLearning ↗ · 昨天

作者开发了一个确定性图像路由系统,对图像进行分类,决定是作为原始字节发送还是通过OCR提取文本,实现了LLM上下文集成中令牌消耗的88%减少。

0 人收藏 0 人点赞
#token-optimization

@cursor_ai: 我们已将Cursor中的令牌成本降低了7%,且智能体质量未受影响。节省源于更紧凑的提示、选择性工具加载……

X AI KOLs Timeline ↗ · 5天前 缓存

Cursor AI 通过更紧凑的提示、选择性工具加载、更好的缓存和压缩文件读取,将其工具中的令牌成本降低7%,同时确保智能体质量不受影响。

0 人收藏 0 人点赞
#token-optimization

@levie: 在 Box,我们一直在测试 Opus 5.5 在处理非结构化数据的各种复杂企业知识工作任务上的表现…

X AI KOLs Timeline ↗ · 6天前 缓存

Box 测试了 Claude Opus 5.5,发现它在复杂的企业知识工作任务上,相比 Opus 5 带来了显著的性能提升,在 token 效率、速度和成本方面都有重大改进。

0 人收藏 0 人点赞
#token-optimization

如果你正在构建多智能体AI,停止浪费令牌:GCB + KRE

Reddit r/openclaw ↗ · 2026-09-17

本文介绍了GCB和KRE作为两个层,用于优化持久化多智能体AI系统中的令牌使用和上下文管理,在保持能力的同时降低成本。

0 人收藏 0 人点赞
#token-optimization

在90个模拟日内对比记忆系统与“发送完整对话历史”:上下文令牌减少23-62倍,个人事实召回效果相当或更优,以及记忆明显失败的一个地方(数字和方法)

Reddit r/AI_Agents ↗ · 2026-09-16

本研究对比了AI代理中的记忆系统与完整对话历史在模拟天数内的表现,显示记忆系统可将上下文令牌减少23-62倍,在个人事实召回上效果相似或更好,但在数字数据和特定细节(如标识符)上表现不佳。

0 人收藏 0 人点赞
#token-optimization

@EricSimons: 是时候加速开放权重模型达到前沿了。并让充足的token惠及所有人。今天我们启动了Forge, ...

X AI KOLs Following ↗ · 2026-09-14 缓存

Forge 是由 Eric Simons 与 Arcee、Microsoft、Vercel、Fireworks 和 DigitalOcean 合作推出的研究预览,提供高达50倍的使用量于 GLM 5.3、Kimi K3 和 DeepSeek v4 等开放权重模型,以加速开发并使充足的token易于获取。

0 人收藏 0 人点赞
#token-optimization

我的个人解决方案:应对上下文膨胀的看板系统

Reddit r/AI_Agents ↗ · 2026-09-09

文章描述了一个个人开发系统,使用看板来协调AI代理,通过将任务执行与主聊天界面隔离,最大限度地减少AI辅助编码中的上下文膨胀。

0 人收藏 0 人点赞
#token-optimization

@github: 使用更多令牌并不总是意味着更好的结果。👀 AI编码效率的真正衡量标准是代理是否……

X AI KOLs Timeline ↗ · 2026-09-08 缓存

GitHub Copilot 通过优化上下文管理而非令牌数量来提升AI编码效率,在减少不必要工作的同时,借助基准测试和实验验证的改进来确保任务质量。

0 人收藏 0 人点赞
#token-optimization

相比GPT-4o直接视觉处理,我将图像处理token使用量减少了约95%,同时保持了大致相同的准确度。这有多重要?[P]

Reddit r/MachineLearning ↗ · 2026-09-08

一位研究人员分享了初步结果,展示了一种方法,与GPT-4o相比,将图像处理token使用量减少约95%,同时保持了相似的准确度,并寻求关于其重要性的反馈。

0 人收藏 0 人点赞
#token-optimization

@coworkerapp: 今天,我们推出 OM2。您的 AI 每次提问时都会从头重新读取整个公司数据。这就是为什么 …

X AI KOLs Following ↗ · 2026-09-03 缓存

推出 OM2,这是一款 AI 工具,为企业数据提供永久记忆,通过降低搜索成本来优化 AI 令牌使用。

0 人收藏 0 人点赞
#token-optimization

@elonmusk:自动令牌优化功能即将推出,以降低您的 Grok @Bot 成本

X AI KOLs Timeline ↗ · 2026-09-01 缓存

Elon Musk 宣布,自动令牌优化功能即将推出,以降低 Grok Bot 用户的成本。一位用户建议了一种变通方法,涉及为特定任务设置专用频道。

0 人收藏 0 人点赞
#token-optimization

使用 Caveman 减少 Claude Code 的 token 使用

Reddit r/AI_Agents ↗ · 2026-08-30

本文介绍了 Caveman,一个开源插件,旨在通过使 AI 响应更简洁来减少 Claude Code 的 token 使用,同时保留重要的技术细节。

0 人收藏 0 人点赞
#token-optimization

Google论文通过状态跟踪替代历史记录,在长会话中将智能体token使用减少94%

Reddit r/artificial ↗ · 2026-08-29

Google推出SKILL.state方法,该方法通过跟踪结构化状态而非对话历史,在长时间会话中减少AI智能体token使用量达94%,实现高精度和高效资源利用。

0 人收藏 0 人点赞
#token-optimization

AI领域人人都想减少令牌使用。但如果最大的令牌浪费源头之一是关系缓冲,会怎样?

Reddit r/ArtificialInteligence ↗ · 2026-08-28

本文探讨了关系缓冲——由意图不匹配产生的额外令牌——如何成为AI交互中浪费的重要来源,并提出了“每个解决意图的令牌数”作为减少计算成本同时保持保真度的指标。

0 人收藏 0 人点赞
#token-optimization

首个完全免费的浏览器代理扩展(代价:广告)

Reddit r/AI_Agents ↗ · 2026-08-26

Retriever AI 已推出一款由广告支持的完全免费的浏览器代理扩展,利用 DeepSeek Flash Code Mode 以最小化成本,并实现从用户工作流程中持续学习。

0 人收藏 0 人点赞
#token-optimization

@hanakoxbt: 智能体 vs 图,清晰解释!生成更多智能体虽好,但存在一个无人明说的上限:五个智能……

X AI KOLs Timeline ↗ · 2026-08-23 缓存

该推文解释了生成多个AI智能体的局限性,并介绍了图工程作为一种技术,通过战略性地管理智能体上下文和工作流程来增强覆盖范围并避免冗余。

0 人收藏 0 人点赞
#token-optimization

@XAMTO_AI: 关于Claude Fable 5系统提示的泄露版,有人制作了token优化版本,并转换成了干净的Markdown格式! 代码仓库声称已将其重构为通用格式,可直接应用于Gemini 3.1 Pro、ChatGPT 5.6等前沿模型。 htt…

X AI KOLs Timeline ↗ · 2026-08-20 缓存

有人将Claude Fable 5的系统提示泄露版进行token优化,并转换为干净的Markdown格式,重构为通用格式,可应用于多种前沿AI模型。

0 人收藏 0 人点赞
#token-optimization

@akshay_pachaar:Sam Altman 在七月为开源工具框架辩护。一个月后,有人推出了它,并且更高效……

X AI KOLs Timeline ↗ · 2026-08-19 缓存

TrueForge 是一个开源代理工具框架,它优化了提示上下文和模型调用,与托管解决方案相比,显著降低了令牌成本,如基准测试所示。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈