我构建了一个治理层,让AI智能体可以构建自己的工具,但不能越过我设定的红线
摘要
作者构建了Arcforge,这是一个治理层,允许AI智能体生成并注册自己的工具(例如,通过OpenAPI创建支付工具),同时在智能体持有API密钥之前就强制执行策略限制(例如,阻止一笔9,999美元的收费)。这是一个早期原型,正在寻求关于护栏的反馈。
我一直看到智能体变得越来越自主——调用API、移动资金——而让我担心的是控制问题。所以我构建了Arcforge来探索这一点。在演示中,智能体没有支付工具,因此它编写了一个OpenAPI规范,自行生成并注册该工具,然后使用它。一笔50美元的收费通过了;一笔9,999美元的收费被我设定的策略阻止,甚至没有到达Stripe。智能体甚至从未持有API密钥。这是一个早期原型。我不是在推销什么——真心想知道这个是否有用,还是我想多了。在让智能体采取真实行动之前,你究竟想要哪些护栏?如果有用的话,我很乐意在评论区分享演示。
相似文章
我把我的AI代理治理平台上线了。来试试攻破它。
作者发布了Bendex Arc,一个面向AI代理的开源治理层,用于强制权限、阻止操控,并包含一个用于测试的实时演示。
我认为AI代理将需要一个操作层
作者认为,随着AI代理变得越来越自主,需要一个治理层来实现控制、可观测性和可审计性,并介绍了Bendex Arc作为解决方案,其组件包括Arc Gate、Arc Replay、Arc Approve和Arc Memory。
我厌倦了那些无所不能的代理,于是构建了这层专门阻拦它们的防护层。
作者开发了Scyvera,这是一个运行时强制执行工具,通过实施声明权限和记录决策来规范AI代理,以解决生产系统中的治理空白问题。
I built a governance layer for CrewAI (pip install crewai-governance)
作者为 CrewAI 构建了一个治理工具,旨在解决多智能体系统中的协调故障问题,该工具包含退出报告、重叠检测和知识继承等功能。
我构建了一个兼容OpenAI的AI智能体防火墙。来试试攻破它。
Arc Gate 是一个兼容OpenAI的防火墙,可跨整个AI智能体会话跟踪权限,并在工具调用执行前从允许升级到阻止。它提供了在线演示,并在GitHub上开源。