如何为你的AI助手添加基于使用量的计费,以及为什么你需要用它来赚钱
摘要
本文解释了固定费率订阅计费为何不适合AI助手,因为推理成本因使用量和模型而异,并推荐Credyt作为无代码解决方案,可预先从客户钱包中授权使用量,防止成本超支。
你用无代码方式构建了一个AI助手。但无代码没有为你准备的部分是:计费。你好,我是Credyt的联合创始人。我们为AI产品构建计费基础设施,我想聊聊大多数无代码构建者遇到得太晚的事情。你发布了一个助手。它运行良好。有人想为之付费。这是个好问题。于是你做了显而易见的事:接入Stripe,每月收取29美元,搞定。但这就是它悄悄出问题的地方。**你的助手每次运行都会花费你的钱。** 每次客户触发它,你都在后台为OpenAI或Anthropic付费。每月29美元的固定订阅假设每个客户的成本是稳定的。但事实并非如此。一个很少使用助手的客户几乎不花你钱。而一个重度用户在循环中使用它,一周内就能花费超过29美元。你现在是在用其他人的钱补贴你的最重用户。**当你更换模型时情况会更糟。** 换掉助手使用的模型,每次运行的成本可能一夜之间下降10倍或上升3倍。你的29美元价格是基于旧模型设定的。没人会在每次模型变便宜或变贵时重新定价订阅。所以你的利润率悄然波动,直到你看到账单才发现。**真正让你受伤的场景是:** 你添加免费层级以吸引注册。有人将你的助手指向一个大任务,走开,任其运行。月底,你的OpenAI账单比收入还高。你没有看到它发生,因为运行时没有人在检查成本。账单是你第一次得知此事。这不是一个“你应该编写速率限制代码”的问题。拥有完整工程团队的公司也会搞错。你使用过的产品曾重建其计费系统,并在此过程中惹恼了所有客户。解决办法不是学习编码。解决办法是首先不要自己构建计费系统。真正有效的做法是:在助手运行*之前*检查客户余额,而不是之后。每个客户都有一个钱包。助手运行要经过该钱包的授权,否则被阻止。你永远不必预先垫付你无法收回的成本。这就是全部思路,而且你无需理解代码即可使用。为什么不直接用Stripe?它计量使用量并在月末开票,但当一个失控运行在周期结束前消耗200美元时,这就太晚了。保留Stripe处理支付;缺失的部分是在花费发生*之前*授权它。**这正是** **Credyt** **所做的,以下是如何无需接触代码就能使用它:** * 每个客户都有一个钱包。使用量实时检查,因此失控用户会被阻止,而不是被悄悄吸收。 * 一个现成的计费门户,你可以嵌入到你的应用中。客户查看余额、充值、管理套餐。无需前端工作。 * 六种可混合使用的定价模式:预付积分、按用量计费、订阅、混合、按席位、免费层级。免费层级有硬性上限,因此试用用户不会推高你的推理费用。 * 你用简明英语描述你的定价(“免费层:每月50次。专业版29美元含1000次。额外每次0.05美元。深度研究每次运行消耗5积分。”),集成会自动为你设置套餐、价格和积分授予。 * Stripe仍处理实际银行卡支付。Credyt位于上层,处理使用量层。如果你正在构建包含AI的东西,并且确实有人可能会为之付费,那么在有客户之前就把计费层做对,而不是之后。
相似文章
18个月内,AI代理的计费将类似于云基础设施定价:可变、多维、实时
预测到2026年底,AI代理计费将采用类似AWS的基础设施定价模式:可变费率、实时追踪、API驱动变更,并认为因成本差异和客户成熟度,固定订阅模式不可持续。
我问我的AI"CEO",代理订阅如何能够覆盖底层的API成本——这真的对吗?
关于AI代理订阅服务如何管理API成本的分析,揭示了池化、使用限制和自研模型所有权是关键因素,而许多转售商则薄利甚至亏损运营。
AI使用收费机制让我感到不合理。
作者认为当前AI使用定价模式存在缺陷,因为用户被收取了不可见的‘思考’token费用,形成了依赖信任的计费系统。他们建议实验室要么调整输出token定价,要么按计算资源明确收费。
与众多AI初创公司合作后,我认为大多数AI聊天应用的定价模式完全不合理
文章认为,大多数AI聊天应用的定价模式不可持续,因为它们将重试、上下文增长和多模型调用等复杂成本隐藏在固定订阅费背后,并提出基于使用量并设置限制和超额费用的定价模式更为可行。
AI代理将需要自己的支付权限
随着AI代理开始管理订阅、云资源和预订,文章认为支付权限需要像API权限一样粒度化,并提出是使用专用凭证还是内部审批逻辑的问题。