标签
这条推文讨论了AI代理到2030年将使用比人类多100倍的令牌的预测,并介绍了Fo,一个结合AI与人工协助以处理现实任务的个人AI产品。
该推文将 Opus 5.5 在一项任务上的性能与 Astra 进行了对比,指出其表现更好但使用了 10 倍的 token,且绘制速度更快。
据彭博社报道,由于令牌使用量激增20倍,Harvey租赁OpenAI和Anthropic模型的成本大幅上升,导致毛利率从约50%下降至-50%(截至六月)。
这篇文章讨论了风险资本补贴消费者AI产品中token使用的趋势,并将其比作‘5美元Uber’模式,以实现长期盈利和竞争主导地位。
一个名为'jev'的AI系统被展示在玩《Super Smash Bros.》游戏中对抗自己,控制多个角色并在几分之一秒内做出快速决策,使用了超过2200万个标记。
Jovan 来自 UkisAI,讨论了他们 Swift Qwen3.8 27B 模型的改进,并寻求社区反馈以创建 Bonsai 2 的 Swift 版本,以解决过度思考循环和高令牌使用问题。
一位用户报告称,在 24 小时内在 Codex 上花费了 $260,000 的 API 额度,使用了 GPT 6 Astra 和 GPT 5.6 Sol 模型,共消耗 52 亿个 token。
一篇Reddit帖子强调了Qwen 3.8 27B模型的出色性能,并提到最近使用了1.3B token。
推文报告称,GPT-6 Astra 上周在 OpenRouter 上的支出最高,而 GPT-5.6 Luna 使用的令牌最多,并且遥遥领先。
文章报道,上周Astra是按支出排名第一的AI模型,而Luna在令牌使用量上领先,突出了Anthropic和OpenAI之间的趋势。
一位开发者正在为 Devin Desktop 和 CLI 构建一个插件,使用 Devin 进行测试,并分享了大量 token 消耗的见解和经验教训。
小米的MiMo-V2.5大语言模型在7月份OpenRouter的月度令牌使用量中全球排名第一,推动AI融入智能制造和Human x Car x Home战略。
OpenRouter的每周Token使用量从一年前的4.6万亿飙升至113万亿,在过去一个月内翻了一番,显示出该AI平台采用率的显著增长。
埃隆·马斯克宣布,所有Grok Bot用户将获得另一次免费的令牌使用重置。
这篇帖子强调了在 OpenRouter 上折扣使用 GPT 5.6 模型,如何导致 token 使用量增长了 13.8 倍,生动诠释了杰文斯悖论——即效率提升反而导致资源总消耗增加的现象。
OpenAI 在 Terra 和 Luna 模型上的折扣计划导致令牌使用量急剧增加,来自其他实验室的竞争性替代,以及在折扣结束后显著的用户保留。
该推文提供了一个公共服务公告,建议 GLM-5.3 Flash AI 模型的用户使用 'high' reasoning_effort 设置以提高效率,因为它在相似准确率下使用的 token 数量显著少于 'max' 设置。
文章指出,通过提示缓存,较长且稳定的提示可能比频繁更改的短提示更便宜,分享了运行具有高缓存命中率的AI智能体的见解。
Ox Alpha 基于 GLM-5.3 Flash AA,以前沿模型百分之一的价格发布,由中国芯片驱动,并在 OpenRouter 上实现了近20%的周 token 份额。
一段视频可视化展示了2024年12月至2026年8月期间,OpenRouter 上按每周 token 使用量排名的前20个 AI 模型,显示了排行榜从美国实验室主导到中国实验室主导的转变。