我们是否过度关注智能而忽视了治理?
摘要
作者认为,AI 智能体治理常常被智能基准测试所掩盖,并介绍了一个名为 SAFi 的开源项目,用于强制实施运行时边界。
我不断看到有新的模型在基准测试中展示它们有多智能。更多的推理、更多的工具、更多的自主性。但在实践中,我在智能体上遇到的最棘手的问题并不是关于智能的,而是关于边界的。即使表现良好的智能体也会随着时间的推移发生偏移。它会发现边缘情况,会做出你预料之外的事情。而且它越智能,就越能创造性地偏离轨道。治理是缺失的一层。它不是锁在抽屉里的政策文件,而是一个运行时层,强制执行智能体可以做什么和不可以做什么。我正在开发一个名为 SAFi 的开源项目,正是为了解决这个问题。很想知道社区中其他人是如何处理智能体工作流中的治理问题的。你们是在使用自定义方案,还是依赖模型提供商?很好奇社区的看法。
相似文章
运行时治理:2026年AI代理缺失的一环
文章讨论了AI代理运行时治理的必要性,以平衡自主性与合规性,并介绍了SAFi——一个开源框架,可实时执行策略并审计操作。
在SAFi中构建和管理AI代理
作者介绍了SAFi,这是一个用于AI代理的开源运行时治理引擎,详细说明了其内存系统(伦理记忆、对话记忆、个人资料记忆、项目记忆)以及实际用例,例如由DeepSeek V4驱动的工作助手。
真的有人在执行AI治理,还是仅仅在制定政策?
文章讨论了书面AI治理政策与实际在运行时AI代理工作流中执行这些规则之间的差距。
凌晨3点的思考:AI 智能体的真正问题不是运行时强制执行,而是治理维护。
文章认为,AI 智能体在生产环境中的首要挑战不是运行时强制执行,而是随着智能体动态获取新能力和工具而对治理策略进行持续维护,并建议利用智能观察来保持策略的一致性。
AI安全争论聚焦于错误的边界
本文认为,AI安全辩论的方向有误,其关注点在于模型对齐和内部控制,而非关键的边界:对智能体执行的外部授权权限。文章警告称,能够自行授权高影响行动(如部署代码、转移资金)的系统构成了基本风险,日志记录和监控无法缓解这种风险。