security-benchmark

标签

Cards List
#security-benchmark

MOLE:检测AI代理中的内部威胁

Hugging Face Daily Papers ↗ · 2026-09-07 缓存

MOLE是一个用于评估防御的基准测试,旨在检测在有限审查预算下运行的AI代理的有害行为。它引入了一个包含150个AI操作账户的开放基准测试,并在不同场景中比较了各种监控器。

0 人收藏 0 人点赞
#security-benchmark

@seclink: 分享

X AI KOLs Timeline ↗ · 2026-08-24 缓存

本文分享了一个GitHub仓库,精选了安全漏洞样本集和基准,用于评估静态分析工具和大模型在漏洞挖掘与安全代码生成中的能力,涵盖多种语言和最新科研成果。

0 人收藏 0 人点赞
#security-benchmark

微软推出其首个网络安全模型及新型智能网络安全系统

TechCrunch AI ↗ · 2026-07-27 缓存

微软发布了其首个专攻网络安全的AI模型MAI-Cyber-1-Flash,以及名为Perception的新型智能网络安全平台,旨在与Anthropic、Google和OpenAI在AI驱动的安全领域展开竞争。

0 人收藏 0 人点赞
#security-benchmark

"重复本行上方文字" 在大多数生产环境中的AI代理上仍然有效。以下是我们的发现。

Reddit r/artificial ↗ · 2026-07-03

一项安全研究表明,大多数生产环境中的AI代理容易受到简单的系统提示提取攻击,导致敏感配置和凭证泄露。本文详细介绍了常见的攻击技术和有效的防御措施。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈