@rohanpaul_ai: 智能体的token消耗速率接近人类的5倍,同时其使用量自二月以来已暴涨约14倍。一旦智能体…
摘要
AI智能体消耗token的速率接近人类的5倍,使用量自二月以来已暴涨14倍,这可能会降低像OpenRouter这样的路由器利用模型提供商之间竞争的能力,原因在于缓存和任务连续性。
查看缓存全文
缓存时间: 2026/08/23 15:40
智能体消耗的token量几乎是人类用户的5倍,而自二月以来其使用量已激增约14倍。
当智能体成为OpenRouter平台上的主要token消耗者后,路由器协调供应商之间竞争的能力可能会大大减弱。
OpenRouter处于开发者与模型运营公司之间。它通过比价策略盈利,即在每次查询时将其分配给当前最便宜的供应商。
如果下一个问题是独立问题,这种做法无可厚非;问题之间无需保持连续性。
但智能体执行长期任务时行为模式截然不同:它会在每个阶段重新发送相同的长段背景指令(即缓存命中)。
缓存命中的内容仅存在于保留着有效前缀的机器上,任务中途重新路由意味着需要重新支付完整的预填充费用。
换言之,模型提供商会将该缓存块存储在内存中,仅收取少量费用用于重复使用。
正因如此,OpenRouter上超过85%的智能体token属于这类廉价的重复使用(缓存提示词),而非全新查询。
数据副本存储在单一公司的服务器上。若任务中途转给更便宜的竞争对手,存储的副本将被丢弃,需重新支付完整区块费用。
这意味着智能体将始终由初始任务供应商服务直至任务完成,路由器以转移业务相威胁的影响力将不复存在。
因此看来,在其他场景受影响之前,路由器可从模型供应商获取的折扣,在智能体流量领域可能率先大幅缩减。
a16z (@a16z): 人类已成为AI的少数用户
智能体消耗的token量是人类用户的近5倍,自二月以来增长约14倍
本周图表:
相似文章
@rohanpaul_ai: OpenRouter 的 token 使用量从 2024 年 1 月的大约每周 100 亿 tokens,增长到 2026 年 8 月的超过每周 90 万亿 tokens,增长了 9,000 倍。如果这种速率…
这条推文强调了 OpenRouter 的 token 使用量从 2024 年 1 月到 2026 年 8 月增长了 9,000 倍,这主要是由代理工作负载驱动的,这些工作负载消耗的 token 数量远超人类交互。
AI代理现在使用的令牌数量是人类的5倍..
文章讨论了当前AI代理使用的令牌数量是人类五倍的发现,这表明了AI能力和效率方面的一个显著趋势。
@rohanpaul_ai: 高盛:"AI代理的Token使用量预计到2030年将增长24倍" AI代理正在创造首个…
高盛预测,到2030年,人工智能代理的Token使用量将增长24倍,并引用成本担忧,Uber和微软正在重新考虑使用昂贵的代理,凸显了人工智能繁荣的一个关键挑战。
OpenRouter 云代理排行榜 - 2026年7月9日
OpenRouter 的云代理排行榜展示了按 Token 消耗排名靠前的代理,Gitlawb 以 83.4 亿 Token 领先,其次是 Ito 和 Roo Code,反映出云代理平台的快速增长。
OpenRouter 上人们实际运行的云 AI 编码代理(按 token 用量排名,基于真实使用数据而非炒作)
OpenRouter 发布了云 AI 编码代理的 token 用量排名,显示使用最多的代理(Roo Code、Ito)与知名度高的代理存在显著差异。数据揭示了炒作与实际采用之间的脱节。