人在回路中正沦为企业作秀。
摘要
Anthropic 警告称,随着 AI 生成代码的速度超过人类审查速度,人工审查正成为瓶颈,这引发了对自主性和安全性的担忧。
Anthropic 的暂停并非出于恐惧,而是承认人工审查正在消亡。Anthropic 表示,前沿实验室应当建立协调且可验证的方式,以便在先进系统开始以超出社会管理能力的速度自我改进时,减缓或暂停 AI 开发。其还指出,截至 5 月,Anthropic 代码库中超过 80% 的合并代码由 Claude 编写,人工审查正成为瓶颈。可怕之处不在于 AI 编写代码,而在于人类已变得过于缓慢,无法对 AI 产出的工作量进行有意义的审查。如果 AI 系统在最少人工输入的情况下设计其继任者,我们是否还拥有未来,还是说我们已经外包了自主性本身?
相似文章
我认为“人在回路中”可能成为企业AI最大的治理幻觉之一
本文认为,依赖'人在回路中'作为治理策略是有缺陷的,因为AI系统现在决定何时升级,形成了一种自我报告的依赖。文章建议转向'人类主导的自主性',即由人类定义边界并审计表征质量。
多数智能体框架中的“人在回路中”只是形式 - 在你批准后,模型仍会执行操作
文章认为,许多AI智能体框架中的“人在回路中”机制是表演性的,因为模型在获得批准后仍然会执行操作,削弱了有意义的人类控制。
引用 Jon Udell
Jon Udell 主张将 'human in the loop' 重新定义为 'human agent in the loop',即人类邀请AI代理进入协作过程,而非被机器驱动的循环所支配。
当AI代理自主执行编码任务时,人类应该处于循环中的哪个位置?
讨论了在自主AI编码代理工作流中人类审查的最佳位置,考虑了自动化与安全性之间的权衡,特别是针对认证、支付和数据库迁移等风险较高的系统。
信任-监督悖论:随着AI变得更好,人类可能不再真正监督它
一篇思想文章,指出随着AI变得更准确,人类监督可能会退化为例行批准,从而产生'信任-监督悖论',即高性能AI仍可能因不完整的表征、过时数据或自动化偏见而失败,建议从人工审查转向治理边界。