构建自己的智能体框架 VS 使用现有智能体框架(如Claude Code)
摘要
作者质疑像Claude Code这样的单体式智能体编码工具的效率,认为一个按阶段路由模型的自定义框架可以在不牺牲质量的情况下降低成本,并向社区询问他们的经验和建议。
有件事一直困扰着我关于当前这一代智能体编码工具,我想知道是不是我漏掉了什么显而易见的东西。在一次会话中,我讨论、规划、审查、实现并推送。所有步骤都通过同一个模型完成。如果其中任何一个阶段需要使用昂贵的模型,我就被迫在每个阶段都支付顶级费用——包括那些用便宜模型就能很好完成的阶段。更甚的是,供应商在每次调用时都注入一个庞大的系统提示,所以无论我是否需要,token开销都已经被包含在内。那么问题是:如果我构建自己的框架,能否按阶段拆分工作流,并将每个阶段路由到它实际需要的模型?脚手架和模板用便宜模型,架构和审查用昂贵模型。这似乎应该能在不牺牲质量的情况下显著降低成本。我找到了一些覆盖部分功能的工具——例如Pi Coding Agent和BMAD-METHOD——但没有一个能覆盖整个循环,也没有一个带有值得使用的UI。这正是最让我惊讶的:有很多CLI框架,但几乎没有任何带界面的工具。所以:你实际在使用什么——是已有的工具,还是自己构建的?已有的工具真的更好吗?有什么是我只有在自己构建之后才会发现的?如果按阶段路由模型是这样一个明显的成本杠杆,为什么没有人把它和一个像样的界面一起发布?真心求问。如果这是个坏主意,有原因的话我宁愿现在就听到。或者,如果已经有这样的工具,那我可能是井底之蛙——如果是这样,请告诉我,我会很高兴地把头伸出井外。
相似文章
自定义工具链有意义吗?
本文探讨了AI辅助编程中的两大阵营:使用现有工具链如Codex配合工具和AGENTS.md, versus 构建自定义的编排代理。作者支持前者,认为后者被过度炒作。
Building an Advanced Agentic Harness
A technical blog post that walks through building a production-grade agentic harness around a basic LLM loop, covering typed tools, plan DAGs, tiered memory, verification hierarchies, budgets, and tracing.
在同一个工具集中跨 Claude Code、Codex 和 Ollama 路由编码智能体会话——按会话挑选模型
一位开发者描述了如何构建一个多引擎智能体编码工具集,在 Claude Code、Codex 和 Ollama 之间路由会话,并根据任务价值为每个会话从十二个模型中进行选择。
框架还是模型?通过受污染控制的私有测试套件隔离代理编程中的框架效应
该研究使用受污染控制的私有基准测试,隔离了代理编程系统中框架与模型的影响,发现供应商原生框架并无一致优势,且在成本和任务性能上存在差异。
最喜欢的代理式编码工具
作者比较了几种代理式编码工具(Codex CLI、Claude Code、Gemini CLI、OpenCode、Pi),认为Pi最精简且最适合本地模型,赞赏其简洁性以及与Qwen 27B-MXFP8的兼容性。