标签
作者构建了AgentPaySec,这是一个用于具有财务权限的AI代理的安全测试平台,并在模拟的支付代理上进行了测试,发现了漏洞,目前正在寻求社区对攻击场景的反馈。
HarnessRisk 是一种面向生命周期的基准测试,专门评估代理工具安全性,揭示了配置漏洞和检测缺口,这些漏洞和缺口允许高攻击成功率,同时保持系统的效用。
本文讨论了为更多编程语言创建基准测试以评估大语言模型的网络安全能力,并宣布了JSEF v1.3.0的发布,该工具是一个Java安全教学框架和基准,用于衡量SAST工具和LLMs的漏洞检测能力。
Antitech 为AI代理提供免费的早期安全评估服务,针对提示注入、工具滥用、数据泄露等攻击向量进行测试,并提供漏洞报告和参与折扣。
RedBench 引入了一个通用数据集,聚合了 37 个基准数据集,包含 29,362 个样本,涵盖 22 个风险类别和 19 个领域,用于实现大型语言模型的标准化和综合红队测试评估。该工作解决了现有红队测试数据集中的不一致问题,并提供了基准、评估代码和开源资源,用于评估 LLM 对对抗提示的鲁棒性。