个人观点:如果你预算有限,刚性代码优于灵活代码
摘要
作者分享了在预算有限的情况下构建本地智能管道的经验,得出结论:在可靠性和资源使用方面,刚性Python代码优于灵活的AI智能体。
1. 过去六个月里,我一直在尝试为我日常使用的文本处理和提取工具构建一个完全本地的智能管道。
2. 因为我所有东西都在单张消费级GPU上运行,所以我的选择仅限于较小、量化后的开放权重模型(主要是在Gemma 4 31B和Qwen 3.5的各种变体之间切换)。
3. 每次新模型发布,我都会加载它,看看Hugging Face上的基准测试——因为说实话,每次有新东西出来我都会疯狂焦虑——然后心想:“终于,这个模型应该有能力自主规划整个执行逻辑了吧。”
4. 但从未成功过。我给了(我的原型智能体)模型一个庞大的系统提示,给它一堆工具,希望它能自主分析输入的非结构化数据,决定最佳处理步骤,处理边界异常,并输出干净的JSON。有一天它执行得很完美。
5. 第二天,它就不工作了——就像“不,我不干了”。一切都会变得嘈杂,温度飙升之类的。我花在调整提示权重和温度上的时间比实际使用数据的时间还多。于是我用传统、枯燥、完全刚性的Python代码替换了推理循环。脚本不再要求模型思考工作流,而是自己完成了所有繁重的工作。
6. 它负责分块文本、处理API逻辑、运行严格的正则表达式过滤器,并管理执行流程。我把本地LLM的任务精简到最低限度:查看这个确切的300字块,提取这三个特定实体,并严格按模式输出。如果文本块不符合预期标准,代码立即抛出错误并将其转入人工审核文件夹。
7. 模型不再被允许做出执行决策。结果呢?我的处理速度提升了,资源占用下降了,管道已经连续运行了四天,没有出现任何逻辑错误。但也许这只是风暴前的平静吧,老兄,谁知道呢?
8. 一个使用高度专业化本地模型作为简单数据解析器的笨拙、刚性脚本,比一个需要人类保姆确保它不会在边界情况上发疯的“聪明”智能体有价值得多。
9. 但这只是我的个人观点。
相似文章
编码代理的真正障碍不是代码质量——而是你是否能围绕它们构建一个可靠的循环
文章认为,AI编码代理的主要挑战不是代码生成质量,而是用户能否围绕它们构建可靠的循环,这将采用的障碍从模型能力转移到了工作流设计。
@bibryam: 使用代理,保持主导权. https://devindickerson.dev/posts/using-agents-keeping-agency/…
一篇博客文章警告,AI 编码代理通常会默认选择流行但不适用的技术,导致技术债务,并敦促开发者在架构决策中保持主导权。
@rohit4verse:AI 并没有让代码变得廉价,而是让劣质代码变得致命。Matt Pocock:“软件基础比以往任何时候都更重要”AI 在……
探讨了 AI 如何放大代码质量的影响,强调软件基础比以往任何时候都更重要,并推荐了构建可靠 AI agent 的五种设计模式。
我认为很多人低估了不可靠 Agent 的成本有多高
作者指出,不可靠 AI Agent 的隐性成本在于持续人工监控所带来的认知开销,并强调在实际落地中,可预测性与环境稳定性远比模型的原始智能更重要。当 Agent 运行在受控且经过验证的环境中,而非充满不确定性的环境时,实际工作流的效率将得到显著提升。
一位开发者分享关于如何最大化AI代理能力的见解,认为更简单的设置和理解核心原则比复杂的工具和库更有效。
一位开发者分享关于如何最大化AI代理能力的见解,认为更简单的设置和理解核心原则比复杂的工具和库更有效。