我们不断赋予AI智能体更多自主权、减少监管,这开始让人觉得是在倒退。
摘要
文章批评了赋予AI智能体更多自主权、减少人类监管的趋势,认为这忽略了来之不易的软件工程实践(如代码审查和分阶段发布),导致静默失败和意外成本。
每一个新框架的发布都带着同样的吹嘘——比如更长的任务链、更多的工具访问权限、更少的“与人类确认”检查点。好吧,这很酷。但几乎没有人讨论当其中一个智能体悄悄做错事连续三天而无人察觉时会发生什么。我看到一些讨论中,有人智能体整个周末都在默默重试一个失败的API调用,累积了高额成本,而最高赞评论基本上是“是的,这经常发生”。我们花了二十年时间建立了一整套围绕代码审查、分阶段发布、灰度部署的规范,正是因为软件会以无聊、静默的方式失败,而不是戏剧性的方式。感觉智能体们正在跳过这一整课,因为每个人都在急于发布主页上最“自主”的东西。那么真诚地说,对于在真实场景中运行智能体的人来说,到底是什么在阻止一个坏智能体造成损害?还是大多数团队仍在自行拼凑这些防护措施?
相似文章
我认为我们给予了AI代理过多的自主权
作者认为,在没有适当安全措施的情况下,AI代理被赋予了过多的自主权。
AI代理不仅仅需要更多的自主性,更需要关于何时停止的更好判断。
本文认为,AI代理需要更好的判断力来决定何时避免行动,特别是在数据不完整或结果不可逆的情况下。同时,受控的自主性对公司来说更值得信赖。
信任-监督悖论:随着AI变得更好,人类可能不再真正监督它
一篇思想文章,指出随着AI变得更准确,人类监督可能会退化为例行批准,从而产生'信任-监督悖论',即高性能AI仍可能因不完整的表征、过时数据或自动化偏见而失败,建议从人工审查转向治理边界。
目前 AI 智能体最大的谎言在于:更高的自主性自动意味着更高的价值
文章认为,AI 智能体的高自主性会增加错误发生的成本,因此主张采用受约束的、可靠的智能体,将安全性和可预测性置于无限制的能力之上。
我最近一直在为企业开发 AI Agent,我认为大多数人高估了自主性,却低估了可靠性。
作者认为,在企业级 AI Agent 开发中,运行的可靠性和稳定性比高度自主性更为关键,倡导受控智能而非完全自主的系统。