我为本地AI智能体构建了一个默认拒绝防火墙(OpenClaw/Hermes)——它会拦截每一次工具调用,并在执行任何可能存在风险的操作前征求我的批准
摘要
一个针对本地AI智能体的默认拒绝防火墙守护进程,拦截每一次工具调用,阻止危险操作,并对模棱两可的操作请求用户批准,同时具备防篡改日志记录。旨在降低提示注入风险。基于MIT许可证开源。
我对于让智能体完全访问我的机器感到不安——提示注入意味着一个带有陷阱的文件或网页可能会劫持它们,利用我的权限造成破坏。因此我构建了一个小守护进程,驻留在智能体与操作系统之间:每次工具调用都会根据默认拒绝策略进行检查。危险操作(如读取.env、执行rm -rf)被硬性阻止,模棱两可的操作会向我的手机发送通知以批准或拒绝,所有操作都会记录在一条防篡改的日志链中。这就像"第二把锁,而不是金库"——我在README中坦诚说明了无法阻止的情况(完全被攻陷的智能体会绕过自身的工具层)。基于MIT许可证开源。非常欢迎大家质疑这个威胁模型:https://github.com/VickyTarun89/clawguard
相似文章
我构建了一个兼容OpenAI的AI智能体防火墙。来试试攻破它。
Arc Gate 是一个兼容OpenAI的防火墙,可跨整个AI智能体会话跟踪权限,并在工具调用执行前从允许升级到阻止。它提供了在线演示,并在GitHub上开源。
Claw Patrol: 一个面向代理的开源安全防火墙
Deno 开源了 Claw Patrol,这是一个面向 AI 代理的安全防火墙,它通过隧道路由流量、解析协议、注入凭据并执行规则,以防止危险操作(如删除 SQL 或 kubectl 命令)。
Show HN: Claw Patrol,面向AI Agent的安全防火墙
Claw Patrol 是一款面向AI Agent的安全防火墙,位于Agent与生产环境之间,通过HCL规则解析流量并管控行为,可拦截破坏性SQL操作,或对kubectl delete pod等风险命令要求人工审批。
为什么AI代理没有确定性防火墙?
一位开发者用Rust为AI代理构建了一个确定性防火墙,运行时间低于5毫秒,使用计划、MCP列表和污点追踪来强制执行安全,避免幻觉和延迟问题。
我建了一个插件,让OpenClaw在做任何有风险的事之前先问我手机
OKed 是一个 OpenClaw 插件,拦截风险性工具调用并在执行前需要用户批准,防止代理执行删除数据或发送付款等破坏性操作。