标签
作者认为,对于AI数据库代理来说,单一的确认对话框是不够的,提出基于爆炸半径的分层审批以及用于事件审查的持久证据链。
本文提出了一种最小自主性理论,作为针对自主性人工智能系统的最小特权原则的泛化,定义了组合影响半径和智能体影响图,以检测授权组合和跨域能力组合。
文章认为,AI编程加速了开发速度与系统重要性的脱钩,导致关键系统变得脆弱且故障波及范围广,并倡导实施强制谨慎设计的‘慢速软件’。
本文介绍了Chimera开源智能体的两项新安全功能:按会话的工具许可名单以限制工具访问,以及gVisor沙箱以减少主机内核暴露面,旨在缩小智能体的爆炸半径。
Cross Repo Review 是一个工具,用于映射仓库间的依赖关系,并在 PR 上展示下游影响、破坏性变更和影响范围,同时追踪代码、服务、数据和管道依赖。
介绍 Ripple,一个 VS Code 扩展,它在本地分析 JS/TS 项目,为 AI 编码代理提供编辑前的文件依赖和影响上下文,解决 AI 代理因缺乏影响范围意识而导致意外损坏的问题。
Anthropic讨论了如何通过遏制架构限制影响范围并减少人类监督疲劳,从而在多个产品中管控Claude,并分享了从部署Claude.ai、Claude Code和Claude Cowork中获得的经验教训。