不使用智能体循环,将浏览器智能体成本降低50倍。先规划后执行 + 数据。
摘要
描述了一种通过单次规划调用后确定性执行来降低浏览器智能体任务中LLM成本的技术,与标准智能体循环相比,实现了50倍的成本降低。
相似文章
如果你运行多模型智能体循环,你在哪里划分廉价节点/昂贵节点的界限?
作者分享了一种降低多模型智能体循环成本的策略:使用廉价快速的执行器处理重复节点,并使用强大的规划器进行高层推理,同时分享了在OpenRouter上使用Ling-3.0-flash的经验。
Agent Execution Tax:浏览器代理基准测试的新衡量指标
Fireworks AI 和 Notte 在运行了四个 LLM 的 720 个浏览器代理任务后,引入了 'Agent Execution Tax' 指标,发现执行可靠性——而非智能——是智能体 AI 的主要瓶颈,其中一个模型在格式错误的 JSON 上浪费了 22.9% 的推理调用。
@SunNeverSetsX: 分享我珍藏的 4 个让 Agent Loop 跑得更快、更好的基础设施,一定要让你的 Agent 用上! 1. http://agent-browser.dev 让 Agent 在真实浏览器里点击、验证 UI 变更,实现真正的自闭环测试 …
agent-browser is a CLI tool for browser automation designed for AI agents, using compact text output and ref-based element selection to minimize token usage. The post also highlights three other tools—portless, emulate, and ai-cli—for improving agent loop efficiency.
子代理在长代理运行中占据大部分Token成本:实际可将使用量降低70%至90%的修复方法
本文分析了 Bai 等人 2026 年的论文,该论文表明,子代理和上下文膨胀导致长代理运行中的Token成本比普通聊天高出约1000倍,并提出了三种实用的修复方法(PLAN.md、读取预算、带外备注),可将Token使用量减少70-90%。
@heyshrutimishra: 运行浏览器代理最昂贵的部分不是任务本身,而是任务之前的一切。导航、查找…
Webcmd 是一个开源工具,它教会浏览器代理一次性学习网站导航并重复使用,从而大幅减少重复任务中的token浪费。它支持99个网站,并可在本地运行。