有人想了解先进公司是如何在实际生产环境中运行AI代理的吗?
摘要
作者在一家AI基础设施公司工作,观察到在实际生产环境中运行AI代理更多是关于环境、访问控制、隔离和安全状态管理,而非模型本身,并询问社区是否想要详细的架构模式。
大家好,我写这篇是想看看这里的人是否想要更多关于公司实际如何在内部运行代理的真实案例分析——不仅仅是随机的营销文章。我在一家AI基础设施公司工作,最近变得非常明显的一点是,一旦代理开始与真实系统交互,难点就不再是模型本身。而是:
1. 代理运行的环境是什么
2. 它被允许访问什么
3. 如何隔离凭据
4. 如何安全地验证更改
5. 如何阻止不良状态到处传播
我们在客户那里看到的许多更先进的设置基本上是把代理当作不可信的基础设施工作负载来对待:隔离沙箱、热执行池、限定范围的凭据、临时环境、每个代理的工具配置,以及跨Slack/GitHub/CLI等的编排。
这个领域仍在发展。Anthropic已经开始更多谈论沙箱化,减少影响范围是这个行业自然的发展方向。
如果有人感兴趣,我很乐意分享实际的架构模式/用例,我也可以链接公开的客户案例,或者与正在构建类似东西的人通话。似乎每个在从事这方面工作的人现在都独立地重新发现相同的基础设施/安全教训。
相似文章
真有人在实际生产中为客户运行AI代理吗?还是仍是演示品?
一个讨论,质疑AI代理是否真正在生产中用于客户工作,还是主要停留在演示阶段,反映了炒作与现实可靠性之间的差距。
有没有人真正在生产环境中使用AI代理(面对真实用户,不是演示,也不是10个测试用户)?你的技术栈是什么?有没有人在尝试将代理用于生产后又回归传统代码——为什么?
一个讨论贴,询问关于拥有100+用户的真实AI代理部署情况,涉及技术栈和扩展问题,以及回归传统代码的经验。
在生成环境中运行AI代理:如何控制它们实际允许执行的操作?
一位开发者寻求关于如何在生产环境中控制和约束AI代理行为的建议,特别是当它们与真实系统(如数据库和客户数据)交互时,询问当前实践情况以及这是否是一个已知的难题。
在AI代理投入生产之前,还缺少哪些基础设施?
关于运行AI代理所需基础设施缺失的讨论,包括监控、权限、恢复和审计追踪,质疑这是否会成为新的基础设施类别。
是否有人在生产环境中部署了多智能体AI员工?
关于在生产环境中部署多智能体AI系统的讨论,其中不同的智能体负责规划、执行、沟通和项目管理,询问实际经验与瓶颈。