对于智能代理来说,是否有一个好的执行层,还是大家都在自己构建?

Reddit r/AI_Agents 新闻

摘要

作者探讨了为AI代理构建执行层时遇到的挑战,包括处理重试、部分失败和验证(当与多个应用交互时),并询问是否有现成的解决方案或社区实践。

我一直在尝试构建一个iMessage代理,能跨应用为我做些有用的事,但总是遇到同样烦人的问题。模型通常能搞清楚我想要什么以及调用哪个工具。麻烦的是之后的一切。比如:它发送了一封邮件但请求超时了——是失败了,还是邮件实际上发送了?它移动了一个日历事件,然后试图在Slack上给某人发消息,但某个步骤失败了。重试发生后,现在我担心它可能重复执行同一操作。代理说“完成了”,因为工具调用看起来成功,但我其实不确定外部应用最终是否处于正确状态。我一直在想,那些在生产环境中运行代理的人是怎么处理这些的。你们是: - 把未知当作真实状态处理吗? - 在重试前检查外部系统吗? - 维护一个单独的副作用账本吗? - 为每个集成有自定义的重试/幂等逻辑吗? - 使用Temporal / LangGraph / n8n / 其他工具吗? - 有清晰的方式表示跨多个应用的部分完成吗? 我有点希望存在的东西是,我的代理可以直接说:“把这个会议移到周五,保留与会者,用Slack告诉Sarah,并在Notion上更新项目。”然后,某个执行层处理应用特定的调用、重试、部分失败、验证等,并只给我的代理一个清晰的实际发生情况的回执。这样的东西已经存在了吗?感觉我总是不得不围绕Gmail、Calendar、Slack等构建越来越多的自定义执行逻辑,我好奇其他人是否最终也做同样的事。很想知道人们在生产环境中是如何处理的,或者是否有现成的产品我应该使用而不是重新构建这个,哈哈。
查看原文

相似文章