Patronus Ark,一个用于AI代理的本地安全扫描器
摘要
Patronus Ark 是一个新的 Rust 和 Python 库,用于本地扫描 AI 代理的文本和工具活动,覆盖提示注入、PII、数据泄露和与工具相关的风险,无需将数据发送到外部 API。
大家好,我们发布了一个用于扫描 AI 代理文本和工具活动的 Rust 和 Python 库。Patronus Ark 可以检查用户提示、检索到的文档、工具描述、提议的工具调用以及工具返回的结果。扫描器覆盖提示注入、PII(个人身份信息)、数据泄露、敏感文档、工具类别、工具操作以及与安全相关的工具属性。例如,应用程序可以在将文档添加到代理上下文之前扫描文档,在执行工具调用之前扫描工具调用,并在将工具输出返回给模型之前扫描返回的工具输出。Ark 只产生分类结果,不会执行或阻止工具。应用程序决定结果是应被允许、拒绝还是发送审批。核心使用 Rust 编写,在原生检测器不足以覆盖时使用本地 ONNX 模型。Python 绑定通过 PyO3 提供。下载模型文件后,扫描运行不会将所检查的内容发送到外部 API。我是开发者之一,就职于维护该项目的公司。该仓库仅使用 GPL-3.0 许可,另有用于专有分发的单独商业许可。
相似文章
Arcjet
Arcjet 是一个运行时安全平台,旨在通过实时检测提示注入、授权工具调用、对敏感数据进行脱敏,并阻止机器人和滥用行为来保护 AI 代理。
@0x0SojalSec: Awesome AI Security:每个人都在争相部署AI代理,但几乎很少有人正确保护它们。该仓库汇集了…
一个精心整理的GitHub仓库,汇集了用于保护AI系统的框架、工具、攻击矩阵、红队指南、政策模板、数据集及研究,涵盖提示注入、越狱以及OWASP/NIST标准等主题。
OpenAI 推出 Aardvark:智能安全研究员
OpenAI 宣布推出 Aardvark,这是一个基于 GPT-5 的 AI 智能体安全研究工具,能够自动识别、验证和修补代码库中的软件漏洞。该工具与 GitHub 和开发工作流集成,帮助安全团队大规模发现和修复漏洞。
@tom_doerr: 通过状态空间搜索进行渗透测试的自主AI代理 https://github.com/oritera/Cairn
Cairn是一个开源的通用问题解决引擎,利用状态空间搜索进行自主AI渗透测试,基于黑板架构和事实-意图图构建。
Show HN: 我们后训练了一个可进行渗透测试而非拒绝的模型
ArgusRed 是一个 CLI 工具,使用后训练的 AI 模型对代码库进行安全扫描和渗透测试,输出详细的 Markdown 报告。它提供两种模式:安全扫描(只读)和渗透测试(主动利用),并可选择性地进行利用验证。