我一直在为智能体重复构建检查点、重试和运行跟踪。所以我围绕它们构建了一个开源运行时。

Reddit r/AI_Agents 工具

摘要

作者构建了 Tidebase,一个用于智能体工作流的开源运行时,它使用 Postgres 提供检查点、重试和实时运行状态跟踪,使失败的运行可以从中断处恢复。

我为智能体工作流构建了一个小型开源运行后端。它处于早期 alpha 阶段,专为解决我在将长时间运行的智能体投入生产时反复遇到的三个问题而设计:1. 查看智能体运行当前正在做什么。2. 检查已完成步骤,以便失败的运行可以继续而不是从头开始。3. 从相同的运行状态将工作流进度流式传输回 UI。你可以保留现有代码。用 `run.step()` 包裹有意义的步骤。Tidebase 将检查点、运行状态、事件和恢复尝试存储在 Postgres 中。仪表盘显示运行时间线、当前状态、已完成步骤、失败步骤和重试尝试。如果运行中途失败,使用相同的运行 ID 重新运行会跳过已完成的步骤。可选的恢复 webhook 可以回调你的应用以恢复工作流。这会取代你现有的任何重试/状态/检查点管道吗?在你能在真实工作流中尝试它之前,还缺少什么?如果检查点/实时运行状态运行良好,你希望这个工具接下来处理什么?
查看原文

相似文章

推出 Amazon Bedrock 代理的有状态运行时环境

OpenAI Blog

OpenAI 与亚马逊合作,为 Amazon Bedrock 中的代理推出了有状态运行时环境,支持生产级的多步代理工作流,具备内置状态管理、可靠性和治理能力。该运行时原生运行于 AWS 环境,简化了企业用例(如客户支持、销售运营和财务流程)中复杂的代理编排。