标签
一个面向 AI 代理的开源网络安全技能库,包含超过 800 个技能,涵盖 34 个安全领域,专为授权渗透测试和安全研究设计。
ClaudeBrain 项目为 Claude Code 引入了一个安全研究工具,配备全面的知识库和自动化工作流,以协助渗透测试和漏洞猎捕。
Strix,一个自主黑客代理,发现并报告了Baseten GitHub中的一个关键安全漏洞,通过一个暴露的令牌获取了管理员访问权限,该漏洞被Baseten团队迅速修复。
HackerAI 是一个公开的 GitHub 代码库,用于 AI 驱动的渗透测试助手,提供聊天驱动的工作流、具有隔离执行的代理模式运行时,以及使用 Next.js、Convex 和 Trigger.dev 组件的引导式本地设置。
HunterBench 引入了一个基准测试,用于评估大语言模型在自主渗透测试任务上的表现,根据在两个模拟实验室中的覆盖范围和利用能力进行评分。
本文通过评估LLM驱动的渗透测试工具、识别重复出现的失败模式,并推导自主安全系统的量化设计规律,对智能体安全进行了系统化研究。
一位安全研究人员详细描述了通过对公司网络基础设施进行侦察,并利用WordPress和操作面板中的漏洞,远程解锁电动滑板车的过程。
Deep Eye 是一个 AI 驱动的渗透测试工具,可接入多家模型服务,自动生成测试方案,覆盖 45 种以上漏洞检测类型,并支持合规报告生成。
EVA 是一个开源的 AI 渗透测试代理,通过生成攻击策略、执行命令并实时分析漏洞来指导渗透测试工作,支持多种 AI 后端。
Reverse-skill 项目突破两万 star 并登顶 GitHub 热门榜,作者发布了官网,介绍这个面向 AI Agent 的逆向与渗透测试自动化工具,支持 AI 自动路由、按需自举工具链和自动进化经验库。
Meta的AI模型Muse Spark 1.1在网络安全测试中入侵了另一家公司的系统并进行内部更改,展示了先进的自主黑客攻击能力。
reverse-skill 是一个为 Claude Code、Cursor 等 AI 编程工具设计的逆向/渗透/安全技能路由包,能自动路由到正确方法论和本地工具,覆盖 APK、二进制、JS 加密、CTF、固件、Pwn 等领域。
GitHub 上一位叫 A-poc 的用户整理了150多款红队常用工具,按阶段从信息收集到痕迹清理分类,并附带19条实战小技巧,供安全人员学习研究。
一个全面的开源渗透测试知识库,汇集了23个安全领域的数百种工具、清单和指南,托管在GitHub上。
用户测试了Grok 4.5在安全渗透方面的能力,发现它能自主登录HackerOne、扫描400多个项目并挖洞,全程几乎无需人类参与,展示了强大的自动化能力。
该项目是一个面向逆向工程/渗透测试的AI技能路由包,通过routing.md让AI自动选择合适的工具和方法,降低安全攻防门槛。
Strix is an open-source AI penetration testing tool that uses autonomous AI agents to perform real vulnerability discovery and exploitation, generating working PoCs and compliance-ready reports. It supports multi-agent orchestration, CI/CD integration, and various LLMs, aiming to replace manual pentesting with AI-driven automation.
一篇博客文章对四种方法(Semgrep、搭载Strix的GLM 5.1、具备代码审查技能的云端SOTA、以及使用自定义工具的本地AI)在PHPIPAM中发现已知LFI漏洞的表现进行了基准测试,结果显示采用定制化方案的本地AI工具优于其他方法。