在遇到 LangGraph 天花板后,我构建了自己的智能体运行时——将 UI 作为图节点,Postgres 持久化,零编排成本
摘要
作者介绍了 cascaide,这是一个全栈智能体运行时和 AI 编排框架,使用 TypeScript 编写,可在任何支持 JS/TS 的环境运行。它提供 UI 作为图节点、持久化 Postgres 检查点、零编排成本,并且设计为可自托管,无供应商锁定。
我已经构建智能体应用大约两年了。从循环开始,然后转向 langgraph + Assistant UI。自从 lang 生态发布以来,我就一直在使用它,并见证了它的演进。它很棒,易于构建智能体,但当需要更细粒度的控制时,事情变得非常令人沮丧,尤其是在构建有趣的用户体验时困难重重。我喜欢将智能体构建为图的想法,但我真的很想将 UI 也建模为流程中的节点。我感觉自己一直在与抽象作斗争,需要学习的东西太多了。部署是另一场噩梦。我有点吝啬,按节点执行的费用似乎……嗯,不太理想。但话说回来,开发者也要吃饭。大约十个月前,我忍无可忍,开始研究一个我已有的想法。它叫 cascaide。Cascaide 是一个全栈智能体运行时和 AI 编排框架,使用 TypeScript 编写,设计为在任意支持 JS/TS 的环境运行。它最初是为 Web 应用构建的,但也同样适用于无头/CLI AI 智能体和 JavaScript 运行时中的工作流。它实际上是一个分布式、可观察、持久化的图执行器。第一次拆分恰好是客户端/服务器,因此是全栈。以下是尝试它的理由。
🧩 **UI 作为智能体图中的节点** — 不是胶水代码,也不是单独的库。UI 和人机交互是核心原语。
💾 **在崩溃后、数周后或从不恢复工作流** — 每一步都检查点到你自己的 Postgres。无需新基础设施,无需第三方服务持有你的状态。
🔍 **可观察性** — 回放任意智能体运行,分叉状态,检查每次转换。不再有 printf/console.log 地狱。借助 Redux Devtools 查看你需要的一切。
💸 **零编排成本** — 你只为计算付费。无按节点税,无托管运行时费用。
🪶 **核心仅 23kb gzip** — 小到可以真正阅读源码。不是另一个黑盒。包括所有辅助工具、持久化数据库、前端和智能体构建器辅助工具在内仅 46kb。就像你可以认真阅读并理解代码。
🌍 **像其他应用一样部署** — 目前支持 Next.js、Express、Hono、Fastify 的适配器(告诉我还应扩展到哪些原生适配器!)。无需特殊的智能体托管或供应商锁定。
🏗️ **你的数据,你的合规** — 所有痕迹都在你自己的数据库上。HIPAA/SOC2 基础,无需将数据发送给第三方。
🛠️ **开发者体验**
目前很难相信这些说法,我可能作为创建者存在偏见。但 API 表面确实很小:
🪝 客户端两个钩子,用于控制和观察图执行
⚙️ 节点的 `prep/exec/post` 生命周期 —— 状态更新和衍生新节点的两种主要类型
🎮 控制原语用于并发 —— 从服务器端节点内部控制和观察图执行
📐 **图定义**
全部类型化。差不多就这些。通过简单的编程控制可以做很多事情。全部类型化。差不多就这些。通过简单的编程控制可以做很多事情。
🗺️ **下一步**
🔌 **扩展原生适配器** — 目前原生适配器支持:
⚛️ React
🐘 Postgres-js(持久化数据库)
🖥️ 服务器:Next.js、Fastify、Hono、Express
请告诉我接下来应该构建哪些适配器!它设计为模块化——可以快速扩展到更多目标,并且你可以直接替换包来迁移。
🌐 **扩展图分布** — 目前仅支持客户端/服务器拆分。但抽象允许更多环境。目前正在开发:
🔲 Edge
🖧 多服务器
👷 Web Workers
请告诉我接下来应该构建哪些适配器。它设计为模块化。可以快速扩展到更多目标,并且你可以直接替换包来迁移。Web Worker 的角度非常有趣。我们正在构建一些功能,让你可以通过在浏览器沙箱内运行节点,为智能体提供文件系统和 bash。这将是一个零成本的巨大增值。甚至允许完全本地的 BYOK 应用,如在浏览器中运行的 AI 应用。
现在尝试:`npx create-cascaide-app@latest`
开箱即用提供 3 个智能体🤖:
🔎 带搜索功能的 ReAct 智能体
🏨 酒店预订智能体(主管)—— 含两个子智能体和两个 HITL 步骤
🔁 带搜索功能的递归 ReAct 智能体 —— 可递归调用自身以处理复杂任务 —— 每个递归深度可通过迷你聊天窗口追踪
CLI 目前初始化应用支持:
▲ Next.js
⚡ React + Hono
🚀 React + Fastify
🟢 React + Express
相似文章
LangGraph、CrewAI,还是原始A2A——这是我在生产环境中实际运行多智能体编排所学的经验,而非在笔记本中
作者分享了在生产环境中部署多智能体编排框架(LangGraph、CrewAI 和 A2A)的实践经验,并与简单的笔记本实验进行了对比。
我们开源了一个代理运行时,专为人们常忽略的部分构建:在真实硬件上离线运行代理
一个开源的代理运行时,专为在真实硬件上离线运行AI代理而设计,支持硬件I/O(GPIO/MQTT/OPC-UA)作为一级节点和可视化构建器,支持多提供商LLM和本地RAG。
最近受雇于一家获奖的SaaS公司。记录企业真正需要的智能体运行时
一位开发者记录了为一家SaaS公司构建的AI智能体运行时架构,重点聚焦于安全性、工具执行、状态管理以及推理与执行的分离。
我受够了AI代理在生产环境中静默失败,于是为它们构建了一个运行时控制层
作者构建了一个运行时控制层,以解决AI代理在生产环境中静默失败的问题。
@anyscalecompute:大多数 Agent 框架解决了编排问题,却在基础设施方面完全未予解决。最新博文:面向生产的 AI…
Anyscale 发布了一篇技术指南,介绍如何使用 Ray Serve、MCP 和 A2A 协议部署面向生产环境的 AI Agent。文章针对常见的底层基础设施瓶颈,提出了一种解耦的微服务架构,支持 LLM、工具与 Agent 的独立扩缩容。