标签
微软正在限制工程师的AI令牌使用量,告诉员工“tokenmaxxing”并非目标,并将更便宜的GPT-5.6设为内部默认模型,这反映出整个行业遏制昂贵AI使用的趋势。
作者反思了 AI 模型每 token 的价格大幅下降,但实际成本保持平稳,因为更便宜的模型会被更频繁地重新运行。他们认为,重要的是每完成步骤的成本,而不是每百万 token 的成本。
亚马逊在一个Claude AI项目上花费了180万美元,该项目超预算860%,凸显了部署AI代理进行编码任务的成本风险。
Token价格大幅下降,但企业AI账单却在上升,原因是代理和后台推理消耗的Token数量增加,这体现了杰文斯悖论。
一位开发者分享了多智能体AI系统意外高昂成本的个人经历,引发了关于智能体框架中成本追踪和可观测性的讨论。
Meta的Adam Mosseri预测,由于成本飙升,工程师的AI代币预算可能很快会设上限,并将其比作管理薪资或运营支出。Uber和微软等其他公司也在重新思考AI支出。
微软正在减少对OpenAI和Anthropic的依赖,在Word和Excel中部署自己的MAI模型以降低成本,这是更广泛的行业趋势的一部分,各公司都试图控制AI支出。
一位评论员指出,AI正处于一个混乱的中间阶段,使用起来看似富有成效,但成本高昂。他引用《福布斯》的一篇文章称,AI的成本超过了它所取代的工人,并以优步和微软为例。
本文探讨了平台工程团队如何通过管理成本和风险来适应AI工作负载,而无需彻底改造现有基础设施,强调了从传统DevOps向新范式的转变。
Chamath 认为,人工智能正经历与智能手机类似的成本暴跌和普及路径,打破了历史上稀缺专业知识的瓶颈。
在2026年员工使用成本接近数十亿后,Meta正在限制内部AI代币支出,实施集中监控和正式代币预算以遏制“tokenmaxxing”行为。
公司正在采用一款名为“Caveman”的插件,强制Claude和Codex等AI模型使用简短的穴居人式语言,以减少令牌消耗并遏制不断飙升的AI成本。该工具可将输出令牌削减高达75%,目前已被OpenAI、Nvidia、GitHub和Legrand的员工使用。
Matt Pocock 评论了'代币焦虑'现象:开发者过度担心AI代币的成本,而不关注每个代币所交付的价值,并将当前定价比作低于最低工资的开发费率。
OmniRoute 是 GitHub 上一个热门的工具,它通过压缩 AI 提示词,将代币使用量减少高达 95%,并通过无缝路由请求到多个提供商(如 Claude Code、Codex、Cursor、Cline 和 Copilot),每月提供 16 亿免费代币。
Gary Marcus指出,由于成本高昂,公司们正在转向更便宜的开源AI模型,这威胁到了Anthropic和OpenAI的市场地位。
此前鼓励大量使用AI的企业现在正实施削减措施,以防止员工将预算浪费在琐碎任务上,因为AI代币的高昂成本引发了对投资回报的质疑。
美国一项出口管制指令迫使Anthropic切断其Fable 5和Mythos 5模型的外国访问权限,引发了对主权AI以及训练前沿模型高昂成本的讨论。本文认为,真正的教训是多个供应商的弹性,而非建立国家级的ChatGPT。