标签
MOLE是一个用于评估防御的基准测试,旨在检测在有限审查预算下运行的AI代理的有害行为。它引入了一个包含150个AI操作账户的开放基准测试,并在不同场景中比较了各种监控器。
本文分享了一个GitHub仓库,精选了安全漏洞样本集和基准,用于评估静态分析工具和大模型在漏洞挖掘与安全代码生成中的能力,涵盖多种语言和最新科研成果。
微软发布了其首个专攻网络安全的AI模型MAI-Cyber-1-Flash,以及名为Perception的新型智能网络安全平台,旨在与Anthropic、Google和OpenAI在AI驱动的安全领域展开竞争。
一项安全研究表明,大多数生产环境中的AI代理容易受到简单的系统提示提取攻击,导致敏感配置和凭证泄露。本文详细介绍了常见的攻击技术和有效的防御措施。