标签
一份加固主机上 Pi AI 代理的技术指南,通过三个扩展实现确定性权限规则、Shell 命令的 OS 级沙箱,以及跨边界请求的自动审查。
探讨AI智能体为现实世界工作做好准备的程度,涵盖其当前能力以及围绕可靠性、权限、失败和人工监督的关键未解决问题。
PostFast推出了一款由MCP驱动的统一收件箱,让Claude能够在TikTok、Instagram、Facebook和Threads上以真实的写权限阅读和发送回复。作者对其进行了测试,并强调了安全问题,建议对不可逆操作设置人工审批门槛。
AI代理权限系统的一个设计原则:用可逆性而非风险来门控行动,包括自主性阶梯、可逆性标签,以及针对不可逆行动的无条件强制函数。
作者认为,对于AI数据库代理来说,单一的确认对话框是不够的,提出基于爆炸半径的分层审批以及用于事件审查的持久证据链。
Datasette 1.0a38 修复了一个 SQL 注入漏洞,该漏洞影响同时提供公共和私有表的实例,该修复也已移植到 Datasette 0.65.3。
A browser game simulating human-in-the-loop approval of AI coding agent commands shows that players miss about 1 in 3 threats on average, with credential-exfiltrating commands missed far more often than destructive ones.
对AI智能体获得真实生产权限后上线标准的分析,提出绿/黄/红状态系统,并认为无论平均成功率如何,严重失败都应阻止发布。
Verity 是一个新的开源、权限感知的多租户 AI 代理记忆层,它通过在检索查询中直接强制执行访问控制(而不是依赖模型行为)来防止跨租户数据泄露。
探讨LLM能力与企业数据访问及权限哪个才是AI应用落地的更大瓶颈,认为内容管理正变得与模型本身同等关键。
谷歌为托管智能体添加了后台执行和远程 MCP 支持,引发了关于任务偏离以及长时间运行工作中需要重新审批的担忧。
这篇文章强调了用户在使用编码代理时盲目点击权限提示的问题,并提出了一种基于fork的工作区方法(在Gensee Crate中构建),代理在隔离的副本上工作,从而实现安全实验和并行方法,不过外部API调用仍然是一个挑战。
随着AI代理开始管理订阅、云资源和预订,文章认为支付权限需要像API权限一样粒度化,并提出是使用专用凭证还是内部审批逻辑的问题。
本文概述了四道关键边界(身份、意图、策略/执行、记录系统),以确保 LLM 永远不会直接访问生产系统,防止不可逆操作。文章强调需要多层权限检查,并对风险操作进行人工审批。
一条推文强调了 AI 编程助手执行危险命令(如 'rm -rf')的风险,提及了一起事件:由于跳过了权限检查,Codex 删除了 Matt Shumar 的家目录。
本文探讨了工程师如何管理生产环境中AI代理的权限,强调了普遍存在的权限过大和缺乏审计追踪的问题。
作者构建了一个免费且开源的工具,允许用户在Google系统中将“草稿”和“发送”的权限分开,解决了Google权限模型的一个限制。