我为本地AI智能体构建了一个默认拒绝防火墙(OpenClaw/Hermes)——它会拦截每一次工具调用,并在执行任何可能存在风险的操作前征求我的批准

Reddit r/openclaw 工具

摘要

一个针对本地AI智能体的默认拒绝防火墙守护进程,拦截每一次工具调用,阻止危险操作,并对模棱两可的操作请求用户批准,同时具备防篡改日志记录。旨在降低提示注入风险。基于MIT许可证开源。

我对于让智能体完全访问我的机器感到不安——提示注入意味着一个带有陷阱的文件或网页可能会劫持它们,利用我的权限造成破坏。因此我构建了一个小守护进程,驻留在智能体与操作系统之间:每次工具调用都会根据默认拒绝策略进行检查。危险操作(如读取.env、执行rm -rf)被硬性阻止,模棱两可的操作会向我的手机发送通知以批准或拒绝,所有操作都会记录在一条防篡改的日志链中。这就像"第二把锁,而不是金库"——我在README中坦诚说明了无法阻止的情况(完全被攻陷的智能体会绕过自身的工具层)。基于MIT许可证开源。非常欢迎大家质疑这个威胁模型:https://github.com/VickyTarun89/clawguard
查看原文

相似文章

Claw Patrol: 一个面向代理的开源安全防火墙

Lobsters Hottest

Deno 开源了 Claw Patrol,这是一个面向 AI 代理的安全防火墙,它通过隧道路由流量、解析协议、注入凭据并执行规则,以防止危险操作(如删除 SQL 或 kubectl 命令)。

Show HN: Claw Patrol,面向AI Agent的安全防火墙

Hacker News Top

Claw Patrol 是一款面向AI Agent的安全防火墙,位于Agent与生产环境之间,通过HCL规则解析流量并管控行为,可拦截破坏性SQL操作,或对kubectl delete pod等风险命令要求人工审批。

为什么AI代理没有确定性防火墙?

Reddit r/openclaw

一位开发者用Rust为AI代理构建了一个确定性防火墙,运行时间低于5毫秒,使用计划、MCP列表和污点追踪来强制执行安全,避免幻觉和延迟问题。