uber/ADR
摘要
Uber 发布了 ADR(Agentic AI 检测与响应),这是一个面向 AI 代理的开源企业安全系统,包括遥测传感器、基准测试和双代理检测器。随附论文已被 MLSys 2026 接收。
查看缓存全文
缓存时间: 2026/08/04 13:34
uber/ADR
来源:https://github.com/uber/ADR
ADR:Agentic AI 检测与响应
ADR(Agentic AI Detection and Response,智能体 AI 检测与响应)是一个面向 AI 智能体的企业级安全系统。它帮助组织保护面向员工的智能体(如 Cursor、Claude Code 和 Codex),以及面向客户的智能体(如 AI 支持智能体)。
ADR 已在 Uber 生产环境中部署,相关论文被 MLSys 2026 接收:论文 PDF · 幻灯片 PDF
ADR 如何保护企业 AI 智能体
ADR 通过四项互补能力来保护企业 AI 智能体:观察智能体活动、评估防御、检测威胁以及阻止不安全行为。
- ADR Observability:了解 AI 智能体在做什么以及为什么。 在生产环境中,ADR 捕获 7 种以上 AI 编码工具(覆盖 macOS、Linux 和 Windows)的智能体意图、工具使用和执行轨迹,以及内部自动化和面向客户的支持智能体。
- ADR Benchmark:在真实企业条件下测试智能体安全。 ADR-Bench 包含 300+ 个任务、133 个 MCP 服务器,并覆盖全部 17 种智能体攻击技术。
- ADR Detection:高效检测有风险的智能体行为。 其两层架构将高召回率分诊与针对可疑会话的更深层智能体推理相结合。
- ADR Prevention:在不安全行为造成危害之前阻止它们。 该组件未包含在当前开源版本中。敬请期待。
仓库结构
本仓库包含论文中描述的开源 ADR Sensor、ADR-Bench 和 ADR Detector。离线 ADR Explorer 引擎(通过部署前红队演练强化 ADR Detection)不包含在此处。
| 路径 | ADR 组件 | 描述 |
|---|---|---|
| Sensor/ | ADR Observability | 从 Claude Code、Cursor、Codex 等工具收集并规范化智能体遥测数据 |
| Detection/ | ADR Benchmark + Detection | 双智能体检测器、133 个 MCP 服务器、303 个基准任务、基线、绘图脚本 |
| docs/REPRODUCIBILITY.md | Evaluation | 逐步复现基准检测和论文图表的工作流程 |
快速开始:ADR Detection
git clone https://github.com/uber/ADR
cd ADR/Detection
uv sync
export ANTHROPIC_API_KEY="..." OPENAI_API_KEY="..."
默认检测器为 adr(ADR 双智能体)。如需无密钥冒烟测试,请使用 --detector llamafirewall(参见 Detection/README.md)。
完整评估工作流程(解压打包基准 → 运行检测器 → 绘制图表)请参阅 docs/REPRODUCIBILITY.md。
组件文档:
- Sensor/README.md:遥测收集与统一数据模型
- Detection/README.md:ADR-Bench、检测器基线、MCP 基础设施
引用
@inproceedings{li2026adr,
title={ADR: An Agentic Detection System for Enterprise Agentic AI Security},
author={Li, Chenning and Hu, Pan and Xu, Justin and Ozbas, Baris and Liu, Olivia and Van, Caroline and Li, Manxue and Zhou, Wei and Alizadeh, Mohammad and Zhang, Pengyu and Sriramadhesikan, KK and Zhang, Ming},
booktitle={Proceedings of the Ninth Conference on Machine Learning and Systems},
year={2026}
}
或使用 CITATION.cff。
许可证
Apache License 2.0。参见 LICENSE。Detection/benchmark/agentdojo/ 是根据其自有 LICENSE(MIT)随附的第三方代码。
数据声明
Detection/ 包含合成基准测试夹具(假凭据、模拟环境、提示注入场景),仅用于防御性安全研究。详情:docs/OPEN_SOURCE_REVIEW.md。
相似文章
@VivekIntel:ADR:代理式AI检测与响应框架 在企业环境中构建或保护AI代理?ADR(代理式…
Uber 开源了 ADR,这是一个用于监控、评估和检测 AI 代理风险的企业安全框架,包含 300 多项任务的基准测试,并支持 133 个 MCP 服务器。
ARIS:通过对抗性多智能体协作实现自主研究
ARIS 是一个开源研究框架,利用跨模型的对抗性协作,通过协调执行、编排和保障层,确保长期研究结果的可靠性。
解决AI中的ARD问题:Agentic Resource Discovery(2分钟阅读)
一个名为Agentic Resource Discovery(ARD)的新协议,由Google、Microsoft、Cisco、Nvidia和Salesforce支持,旨在标准化AI代理如何发现和使用跨企业系统的工具和服务,使代理能够自主地从不同孤岛中发现和查询资源。
Agentic SABRE:一种面向自适应勒索软件检测的、不确定性感知的神经符号多智能体框架
本文介绍Agentic SABRE,一种面向自适应勒索软件检测的不确定性感知神经符号多智能体框架,它融合了语义和行为证据,结合蒙特卡洛Dropout与可解释的风险-不确定性分流,展示了更高的鲁棒性和可解释性。
Uber Eats 如何使用自调优 AI 多智能体系统(以及为何重要)
Uber Eats 描述其自调优多智能体 AI 系统,用于自动修复商家照片,使用路由、编辑、QA 智能体,配合集中式日志记录,以及一个自主的诊断智能体(Diagnoser Agent),在通过黄金基准测试后自动重写提示并自动部署。