Plimsoll: 一个用于测试提示注入、信息泄露和工具滥用的智能体技能

Reddit r/AI_Agents 工具

摘要

Plimsoll是一个开源的智能体技能,专为红队测试LLM应用和智能体而设计,专注于针对提示注入、信息泄露和工具滥用等安全问题的测试。

我一直在研究LLM/智能体安全,主要涉及提示注入、越狱、信息泄露、工具滥用,以及模型开始使用工具后实际的安全边界所在。加入Anthropic的Cyber Verification Program后,我有更多空间进一步推进这项工作,并逐渐将其发展为Plimsoll。这是一个用于红队测试LLM应用和智能体的开源智能体技能。
查看原文

相似文章

Skill Inspector

Product Hunt

Skill Inspector 是一款开发者工具,可审计 AI 代理技能,帮助防范恶意软件风险。

为你的OpenClaw代理技能提供运行前安全保障

Reddit r/openclaw

SecureSkill 是一款工具,可在 OpenClaw 代理技能执行前进行 10 层安全分析,检测凭证窃取、外呼、Shell 脚本等威胁。它生成一份签名审计报告,并映射到 OWASP、MITRE、NIST 和欧盟 AI 法案标准。