这里有人运行能够实际写入生产系统的AI agents吗?
摘要
一位用户正在寻求其他运行具有写入生产系统权限的AI agents的实践经验,讨论如操作验证、重试处理、审计跟踪和内部所有权等运营挑战。
我正试图与那些在AI agents方面跨越了一条非常特定界限的人交谈。不是那些建议行动的副驾驶。不是那些为人类批准而准备东西的代理。不是只读代理。我指的是那些被允许在生产环境中改变状态的代理。比如更新CRM或ERP,更改订单,发放退款,修改权限,触发工作流,写入数据库,或调用具有真实副作用的API。我很好奇一旦达到那个点,运营上会发生什么。例如:一个代理说它发放了退款。你如何确认它确实发生了?一个请求超时,代理重试。你怎么知道外部操作没有发生两次?几个月后有人质疑某个特定操作。你能重建代理看到了什么,它决定了什么,它发送了什么,以及实际发生了什么变化吗?一旦代理在做重要事情,内部谁负责?代理团队、平台、安全、风险/合规,还是其他人?我特别感兴趣的是听到那些已经在生产环境中处理这种情况的人的意见,而不是讨论理论上应该如何工作。如果你运行具有真实写入权限的代理,我很乐意交流笔记。很乐意虚拟喝杯咖啡聊20分钟(咖啡我请),但我也知道没人需要另一个会议。如果异步更容易,我可以通过私信给你发送几个问题。请随时私信我,或者如果你愿意,可以在评论中分享你学到的东西。
相似文章
你实际上允许AI代理对生产系统进行写入操作的程度如何,而不只是起草或建议?
讨论探讨了允许AI代理在ERP和CRM等生产系统中进行无监督写入操作的当前立场,质疑行业中的障碍和舒适度。
有没有人真正在生产环境中使用AI代理(面对真实用户,不是演示,也不是10个测试用户)?你的技术栈是什么?有没有人在尝试将代理用于生产后又回归传统代码——为什么?
一个讨论贴,询问关于拥有100+用户的真实AI代理部署情况,涉及技术栈和扩展问题,以及回归传统代码的经验。
你们当中那些在生产环境中运行AI代理的人——实际上是如何管理它们的权限的?
本文探讨了工程师如何管理生产环境中AI代理的权限,强调了普遍存在的权限过大和缺乏审计追踪的问题。
在生成环境中运行AI代理:如何控制它们实际允许执行的操作?
一位开发者寻求关于如何在生产环境中控制和约束AI代理行为的建议,特别是当它们与真实系统(如数据库和客户数据)交互时,询问当前实践情况以及这是否是一个已知的难题。
真有人在实际生产中为客户运行AI代理吗?还是仍是演示品?
一个讨论,质疑AI代理是否真正在生产中用于客户工作,还是主要停留在演示阶段,反映了炒作与现实可靠性之间的差距。