个人观点:如果你预算有限,刚性代码优于灵活代码

Reddit r/LocalLLaMA 新闻

摘要

作者分享了在预算有限的情况下构建本地智能管道的经验,得出结论:在可靠性和资源使用方面,刚性Python代码优于灵活的AI智能体。

1. 过去六个月里,我一直在尝试为我日常使用的文本处理和提取工具构建一个完全本地的智能管道。 2. 因为我所有东西都在单张消费级GPU上运行,所以我的选择仅限于较小、量化后的开放权重模型(主要是在Gemma 4 31B和Qwen 3.5的各种变体之间切换)。 3. 每次新模型发布,我都会加载它,看看Hugging Face上的基准测试——因为说实话,每次有新东西出来我都会疯狂焦虑——然后心想:“终于,这个模型应该有能力自主规划整个执行逻辑了吧。” 4. 但从未成功过。我给了(我的原型智能体)模型一个庞大的系统提示,给它一堆工具,希望它能自主分析输入的非结构化数据,决定最佳处理步骤,处理边界异常,并输出干净的JSON。有一天它执行得很完美。 5. 第二天,它就不工作了——就像“不,我不干了”。一切都会变得嘈杂,温度飙升之类的。我花在调整提示权重和温度上的时间比实际使用数据的时间还多。于是我用传统、枯燥、完全刚性的Python代码替换了推理循环。脚本不再要求模型思考工作流,而是自己完成了所有繁重的工作。 6. 它负责分块文本、处理API逻辑、运行严格的正则表达式过滤器,并管理执行流程。我把本地LLM的任务精简到最低限度:查看这个确切的300字块,提取这三个特定实体,并严格按模式输出。如果文本块不符合预期标准,代码立即抛出错误并将其转入人工审核文件夹。 7. 模型不再被允许做出执行决策。结果呢?我的处理速度提升了,资源占用下降了,管道已经连续运行了四天,没有出现任何逻辑错误。但也许这只是风暴前的平静吧,老兄,谁知道呢? 8. 一个使用高度专业化本地模型作为简单数据解析器的笨拙、刚性脚本,比一个需要人类保姆确保它不会在边界情况上发疯的“聪明”智能体有价值得多。 9. 但这只是我的个人观点。
查看原文

相似文章

我认为很多人低估了不可靠 Agent 的成本有多高

Reddit r/AI_Agents

作者指出,不可靠 AI Agent 的隐性成本在于持续人工监控所带来的认知开销,并强调在实际落地中,可预测性与环境稳定性远比模型的原始智能更重要。当 Agent 运行在受控且经过验证的环境中,而非充满不确定性的环境时,实际工作流的效率将得到显著提升。