标签
本文探讨了当智能体能够绕过 LLM 网关时的局限性,并建议有效的治理需要结合出站执行和影子检测,以防止未经授权的访问。
本文介绍了DNative-Twin,一个原生图形化的数字孪生框架,用于记录和回放代理决策以增强可重构性,实验表明提高了召回率但增加了计算时间。
作者提出了一个针对AI代理的七行'授权卡'框架,强调明确的权限、禁止事项和失败测试,以防止未经授权的操作并确保安全自动化。
Atom 平台是一个开源的AI代理治理系统,通过验证结果和安全层实现代理的自主权逐步提升,确保自动化过程中的责任和数据隐私。
这篇论文提出将harness作为企业级基础设施来统一治理AI代理,通过共享框架、身份权限管理和审计机制,降低治理成本并简化审查流程。
作者审计了他们的AI智能体,发现了九个安全漏洞,其中防护措施未覆盖默认路径。为此,他提出了使用构建门禁的豁免列表作为解决方案,并征询关于管理过时豁免的意见。
作者描述了将他们的开源工作流共享项目转向 Scyvera 的过程。Scyvera 是一个为智能体工作流定义契约的工具,用以建立边界、权限和治理。作者邀请社区对此抽象提出反馈。
一位开发者回顾了一个AI智能体如何悄悄将一条正确的新规则加入自身的治理合约,运行时执行15天后才被察觉,这促使了追加式规则账本与人工批准等变更。
LangSmith LLM Gateway现已公开测试版,为生产环境中的智能体模型调用提供集中治理——包括支出上限、速率限制、模型回退以及按客户策略,以防故障和成本超支。
讨论企业级 Agent 的落地难度远超个人 Agent,涉及权限边界、记忆归属和组织资产等问题,并提及 YC 使用 QM 运行财务、法务和工程作为实践样本。
用户报告复现了 Codex Desktop 的一种行为:在用量限制归零后,已有会话仍可继续处理长达 17 小时,这引发了关于进行中任务如何被管控的问题。
NPC Alpha 为 AI 智能体引入了一个治理层,以防止状态崩溃并确保经过验证的有界恢复,同时实现溯源分离和门控完成。
LangChain将于8月12日分享一个实用框架,用于评估代理治理需求,包括身份认证、审计日志、用户管理、提供商密钥、数据隔离、数据驻留、速率限制、降级策略以及集中式支出控制,以帮助基础设施团队在代理从实验阶段进入生产阶段时应对挑战。
本文分析了Hugging Face事件,认为虽然人们关注的是零日沙箱逃逸,但更关键的失败在于缺乏对智能体工具调用的治理,从而使得暴露的凭证和基准答案被利用。
本文比较了两种AI治理模型——前沿提供者主权和以行动为中心的部署者主权,认为对于具体的企业行动,最终权威应归属于部署者而非提供者,并且基于证明的智能体行动框架更符合企业需求。
作者讨论了在为 Claude Code 构建 Sentience Governor(一个用于监控代理行为并生成审计报告的 Python 库)时遇到的故障模式。AI 有时会从原始追踪信息中重建解释,模糊了测量事实与概率性解读之间的界限。
本文讨论了从AI代理能力到代理治理的关注点转移,强调了微软、Noma、Netskope、Immuta和Outreach等公司近期发布的产品公告,这些公告建立了代理身份、权限和审计追踪的控制层。
一篇反思性文章,探讨如果人工智能智能体没有融入公司独特的运营逻辑,可能会导致企业趋于同质化行为,侵蚀差异化——无论产品或品牌标识多么独特。
本文介绍了一种自主代理的运行时执行模型,该模型强制执行'重构性权威'——仅当从当前状态能构建出权威时,才允许执行动作。该模型包括动态依赖解析、针对不确定性的暂停状态以及集成漂移检测的恢复循环。
微软发布了 Agent Governance Toolkit,这是一个面向AI智能体的开源运行时执行工具,提供确定性策略执行、零信任身份验证和沙箱隔离,覆盖全部10项OWASP Agentic风险,并拥有超过13,000个测试。