AI编码代理的护栏到底该放在哪里?

Reddit r/AI_Agents 新闻

摘要

关于在何处设置护栏以防止AI编码代理进行未经授权的更改的讨论,探讨部署工作流各个阶段的摩擦点。

我试图弄清楚团队是如何严格约束AI编码代理的。我们都遇到过这种情况:你让代理修复一个孤立的Bug,结果它却触及了五个额外文件,重构了附近的代码,进行了完全未经批准的工作。标准的建议是“只审查差异”。但到那时,代码已经被搞得一团糟,令牌被消耗,工程师不得不浪费时间整理混乱。如果我们想阻止这种代理范围蔓延,护栏到底应该放在哪里?我看到一些团队尝试将摩擦点放在几个不同的地方:运行前:在代理启动前制定严格的任务契约。运行期间:沙盒化文件和终端访问,使其物理上无法接触其他文件。提交时:Git钩子和严格的允许列表。工作后:在CI中捕捉问题。审查时:更好的PR摘要以加快人工审查。内部:仅信任编码代理平台的内部护栏。对于那些在严肃的生产环境中部署代理的人(跳过炒作,给我真实的工作流痛点):目前什么方法对你真正有效?你迫切希望存在什么工具来解决这个问题?
查看原文

相似文章