我认为我们低估了编程智能体实际需要多少控制
摘要
本文认为,AI编程智能体需要更明确的控制和规则来防止意外行为,建议在开发中转向减少自由度而非增加。
AI编程智能体在编写代码方面变得非常出色。你可以描述一个功能,让智能体访问你的仓库,并让它修改文件、运行命令、安装包、编写测试,并持续迭代直到有效。这令人印象深刻。但我认为还有一个问题没有得到足够重视:是什么阻止智能体以我们不希望的方式解决问题?例如,智能体可能:生成可行但违反架构的代码、因为任务看似简单而跳过测试、引入不必要的依赖、更改无关文件、为了通过测试而非可维护性进行优化、在没有明确解释的情况下进行安全敏感更改。此时,我认为给模型更好的提示是不够的。我宁愿为智能体定义明确的规则:它能更改什么、它必须遵循哪些约定、它必须编写哪些测试、它在完成前必须验证什么。以及,重要的是,它到底更改了什么以及为什么。对我来说,有趣的转变不仅仅是:而是:也许下一代编程智能体需要更少的自由,而不是更多。你在自己的编程智能体中是如何处理这个问题的?
相似文章
AI代理可能需要更少的自由,而非更多。
文章认为,AI代理的关键问题不在于能力,而在于行动范围,建议根据风险建立分级权限系统,而非从一开始就完全自主。
我认为我们给予了AI代理过多的自主权
作者认为,在没有适当安全措施的情况下,AI代理被赋予了过多的自主权。
规格驱动的智能体编程正在悄然削弱我们监督智能体的能力
作者认为,过度依赖 AI 编程智能体会导致人类开发者逐渐丧失关键的技术直觉和代码审查技能,并提出了诸如强制手动编码日等措施,以维持监督能力。
AI代理不仅仅需要更多的自主性,更需要关于何时停止的更好判断。
本文认为,AI代理需要更好的判断力来决定何时避免行动,特别是在数据不完整或结果不可逆的情况下。同时,受控的自主性对公司来说更值得信赖。
代码代理应被视为受限执行者而非架构权威吗?
作者认为代码代理应被视为受限执行者而非自主架构师,提出一种模型,其中人类定义不可协商的约束,代理接收范围狭窄的任务,并附带外部状态跟踪。