大多数基于我的10美元航班API构建的AI代理,使用定时任务效果更佳
摘要
作者认为,许多AI代理任务效率低下,应改用确定性定时任务,将代理保留用于基于判断的解释以节省成本。
我向构建代理的人提供实时航班和酒店价格(flightpowers,每月10美元在RapidAPI上即可获得全部服务),因此我能看到人们实际运行的内容。我的真实看法是,也许只有三分之一的任务真的需要代理。有效的模式很枯燥:一个时间表、一组固定路线、每条路线一次调用、一个阈值和一个消息。有一位客户每天在UTC时间09:00执行相同的18次往返搜索,从未需要模型做任何决定;我自己的扫描器上周为111条路线定价,其中的“代理”部分只是最后写摘要的一句话。烧钱的模式是一个工具调用循环,它决定搜索哪些日期。放任不管的话,它会搜索40种日期组合来回答一个包含6个日期的问题,而每次调用都要付费。嵌套循环枚举日历的效果与模型一样好,更快且账单可预测,而账单是真实的——我自己的免费套餐每天上限是150次后端搜索,像这样的循环在午餐前就会用完。代理真正物有所值的地方是最后一公里。“169美元对十月来说真的便宜吗”是一个判断性问题,一个带有Google跟踪价格范围的模型能很好地做出这个决定。我绝不会将其写成代码。所以我的规则是:在扇出部分使用确定性方法,在解释部分使用模型,而昂贵的错误是让它选择搜索空间。我处于供应方,因此请酌情考虑,说这话让我花钱!我这边无法判断的是,40日期循环是人们在原型设计还是生产中运行。如果你正在运行一个,是哪一种?
相似文章
我们是否默认过度配置了AI智能体?
文章认为,许多AI智能体工作流将每个任务都路由到前沿模型,浪费了资金,并建议对简单、结构化的任务使用更便宜的模型层级,同时将更困难的任务升级。文章提供了一个成本比较,显示分层方法可节省高达75%的费用。
今年为客户构建了40多个AI工作流... 说实话,90%的‘智能体’都是噱头
作者批评了围绕自主AI智能体的炒作,指出它们往往无效,并推荐使用n8n和Claude Sonnet等工具构建实用的、硬编码的AI工作流,用于实际应用。
我认为很多人低估了不可靠 Agent 的成本有多高
作者指出,不可靠 AI Agent 的隐性成本在于持续人工监控所带来的认知开销,并强调在实际落地中,可预测性与环境稳定性远比模型的原始智能更重要。当 Agent 运行在受控且经过验证的环境中,而非充满不确定性的环境时,实际工作流的效率将得到显著提升。
我们究竟在什么时候决定,添加第五个监督智能体比编写三个确定性 if 语句更好?
本文批评了将AI智能体过度用于确定性任务的现象,分享了一个案例研究,其中使用更简单的代码重构了一个多智能体客户支持系统,从而降低了延迟和成本。
计算机操作比结构化API调用贵45倍
一项基准测试显示,完成相同任务时,计算机操作代理的成本是结构化API调用的45倍,主要原因是截图和多步骤产生的高令牌消耗。作者认为,对于状态暴露的内部工具,基于API的代理效率更高,并推广了Reflex 0.9——该版本可从应用处理器自动生成API。