研究表明如何构建LLM智能体框架

Reddit r/artificial 工具

摘要

ATOM是一个开源、自托管的AI智能体平台,旨在通过可控自主和验证结果,帮助AI智能体成功从试点阶段过渡到生产环境。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/08/27 13:33

rush86999/atom 来源:https://github.com/rush86999/atom # ATOM 平台 ### 治理型代理平台——自主权,凭实力赢得。 Atom 平台 88% 的 AI 代理试点项目从未进入生产环境。* Atom 是为另一条道路而构建的。 行业数据(Turion 2026)。Atom 不对其自身的部署情况做出任何声明。 许可证 CI (https://github.com/rush86999/atom/actions/workflows/ci.yml) 测试 治理 Python Stars — ## 什么是 Atom? Atom 是一个开源、自托管的 AI 代理工作团队——由专业代理(销售、支持、财务、工程)组成的团队,您的团队成员可以用自然语言向它们委派任务。 其他平台销售的是代理的能力,而 Atom 销售的是代理的问责制:通过验证结果赢得的自主权,在您自己的硬件上、于一个确定性的安全网络中执行。 代理凭实力赢得信任,而非与生俱来。 Atom 的代理不仅仅响应命令——它们在治理边界内自主运行,端到端地处理日常工作。每个代理都从受监督的实习生起步,只有经过验证成功的运行——10/25/50 个回合、结果经过检查而非自我报告——才能通过四层成熟度模型(学生 → 实习生 → 受监督 → 自主)毕业。 验证结果,而非自我报告。 每一个变更操作都会由一个独立的后置条件预言机(默认启用)根据您的权威记录系统重新推导验证,置信度分为自我报告外部验证。一个说“完成”的代理会受到核查,而非轻信。任何层级的提示注入攻击代理,其行动范围仅限于该层级的限定影响半径——由默认启用的沙箱层加以约束:文件系统范围、工具白名单、绊线、资源上限、终止运行、出口允许列表、完整的出处审计。每次检查 P99 耗时 0.027 毫秒。 您的数据始终属于您。 工作流数据、代理状态和记忆存储在您的基础设施上——嵌入式存储,无需云端。LLM 推理使用您自己的 API 密钥(BYOK,静态加密)——或本地模型(Ollama 为一等支持,或任何兼容 OpenAI 的本地服务器:LM Studio, vLLM, llama.cpp server),以实现完全私有的部署。 EU AI 法案的数据治理义务(2026年8月)?为应对而设计,而非事后补救。 免费版,全功能(AGPL v3):此仓库中的所有内容——每一个代理、集成和治理功能——均免费且开源。您在 .env 中配置的密钥被视为 BYOK,绝不会被套餐或层级限制。商业/托管版本在客户的自有基础设施上运行相同的代码;不存在闭源的“专业”版本。 💰 经济实惠的 AI 代理:OpenCode Go 订阅(相比按 token 付费节省约 90%)——一个每月 10 美元的密钥即可解锁通用模型(DeepSeek V4, Kimi K3, GLM 5.2, MiniMax M3, Qwen 3.7, Nemotron 3 Ultra, Grok 4.5),支持完整的工具调用与结构化输出——不仅用于编码,也适用于任何代理工作负载。 设置指南 → 无锁定:支持 16+ 种 LLM 提供商(OpenAI, Anthropic, DeepSeek, Gemini, MiniMax, Groq…),具备自动的成本感知路由、故障转移和自愈能力——每次运行都使下一次运行更便宜(学习型路由器 + 多层缓存)。 愿景:每位员工都拥有一个了解其工作流程、能跨周记忆上下文、并能自主处理重复性工作——研究、数据录入、起草、对账——的个人代理团队,同时治理机制让您保持控制权。不是 AI 替代人类:而是 AI 处理人类不应做的工作。 — 依据:0.027ms P99 治理检查(仓库基准测试)· 616k 次操作/秒缓存吞吐量 · 69+ 个有文档记录的 TDD 强化轮次(仅深度安全扫描就修复了约 1,100 个问题)· 85k+ 个测试函数(2,759 个文件中包含 84,737 个,经 2026 年 8 月验证)。外部统计数据来源于 docs/marketing/RESEARCH_NOTES.md;文案工具包在 COPY_README.mdPOSITIONING.md — ## 💻 快速开始 从克隆到第一个治理型工作流,约需 10 分钟。 从一个小目标开始——一个工作流、一个集成、一个审批门。 bash git clone https://github.com/rush86999/atom.git && cd atom make setup # 一次性开发环境引导 (venv, 依赖, .env, 前端) make backend # 完整后端运行在 :8001 # 在第二个终端中: make frontend # Next.js UI 运行在 :3001 要使用 LLM 功能,请在 backend/.env 中设置一个密钥(或通过 设置 > AI 添加): - OPENCODE_API_KEY 用于低成本订阅式编程模型(节省约 90%,推荐)或 - OPENAI_API_KEY / ANTHROPIC_API_KEY / DEEPSEEK_API_KEY / GOOGLE_API_KEY … 或 - ATOM_LOCAL_ONLY=true + OLLAMA_BASE_URL=http://localhost:11434/v1 用于完全本地运行 预期结果: 打开 http://localhost:3001 → 使用 [email protected] 登录(密码位于 backend/logs/bootstrap_admin_password.txt)→ 用自然语言描述一个工作流,观察它在最终发布前构建并包含一个审批门。 完整快速开始 → · Docker → · DigitalOcean 一键部署 → (https://cloud.digitalocean.com/apps/new?repo=https://github.com/rush86999/atom/tree/main&config=deploy/digitalocean/app.yaml) 独立运营者? 跳过设置——导入一个预置的个人入门套件(发票催收、候选人管道、支持分流),每个都带有审批门,未经您的批准不会发送任何内容: 个人 → 团队手册 → — ## 🚀 AI 生成的自动化工作流 描述结果。Atom 构建并运行工作流。 | 您说的话 | Atom 交付的内容 | |—|—| | “当 HubSpot 中有一个潜在客户时,研究该客户公司、评分、为销售创建一个 Asana 任务,并通知 Slack” | 一个治理型、可复现的工作流,包含人机环路审批门 | | “从 Gmail PDF 中提取发票数据,与 QuickBooks 匹配,并标记差异” | 端到端管道:Gmail → PDF OCR → QuickBooks 对账 → Slack 告警 | | “监控 Zendesk 工单的情感,自动升级紧急工单,并起草回复” | 实时分流代理,发送前需要审批 | | “从 Salesforce 生成每周销售报告,格式化为 Excel,并通过电子邮件发送给团队” | 定时工作流:SOQL 查询 → 公式计算的 Excel → Office 365 发送 | 与 Zapier/Make/n8n 的区别: - 代理,而非步骤——代理会推理(而非仅仅执行):它们会研究、决策、重试并自我纠正 - 内置治理——成熟度门、人机环路审批、审计跟踪、沙箱隔离 - 自托管与隐私——您的数据、您的密钥、您的基础设施 - Office 原生——真实的 Excel/Word/PPTX 公式计算、实时 Canvas 协作编辑 - 代理创建——您可以与代理聊天来构建/修改工作流(无需拖放) 工作流自动化指南 → · 快速开始 → — ## ⚡ AI 代理格局——Atom 的定位 | | 🧵 消费者助理 | 🧰 开发者框架 | 🏢 企业工作团队 | |—|—|—|—| | 示例 | ChatGPT, Claude, Notion AI, Copilot, Perplexity | LangGraph, AutoGPT, CrewAI, AutoGen | ✅ Atom | | 交互方式 | 单轮聊天,仅被动响应 | 代码优先,自行构建 | 用自然语言委派给代理队友 | | 数据与托管 | 仅云端 | 自托管;自带集成 | 自托管 + 46+ 原生业务集成 | | 治理 | 无 | 自行实现 | 设计即治理 | Atom 是唯一提供以下功能的开源平台: - 企业级治理(成熟度层级、人机环路、审计)——无供应商锁定 - 知道何时询问的代理——自主权根据验证过的记录按操作类型赢得,回归时自动撤销;治理型代理组织,包含委派合同与特权租赁 - 自托管隐私——您的数据、您的密钥、您的基础设施 - 自主代理队友——与您的人员并肩工作,而非仅仅他们工作 - 代理创建工作流——聊天构建,无需拖放 - Office/Canvas 原生——真实 Excel 公式,实时协作编辑 - 46+ 业务集成——Salesforce, HubSpot, Slack, Jira, Stripe, QuickBooks… — ## 📊 比较 | 替代方案 | 焦点 | 关键区别 | 深入了解 | |—|—|—|—| | Hermes Agent (Nous Research) | 个人编码/生产力助手 | 单代理,无治理,无集成,无沙箱 | Atom vs Hermes → | | OpenClaw | 个人生产力,消息优先 | 单代理,Markdown 记忆,智能家居重点 | Atom vs OpenClaw → | | LangGraph / CrewAI / AutoGen | 开发者框架 | 代码优先,自行构建治理与集成 | 为什么选择 Atom? ↓ | | Zapier / Make / n8n | 工作流自动化 | 基于步骤(非代理),无推理,无治理 | AI 生成的自动化工作流 | 简而言之:如果您在评估个人代理 → 选择 Hermes/OpenClaw。如果您需要治理型多代理业务自动化 → 选择 Atom。 完整功能矩阵: 为什么团队选择 Atom ↓ — ## ⚡ 关键能力 | 类别 | 功能 | |—|—| | 🤖 多代理编排 | 皇后代理(结构化工作流)+ 舰队上将(开放式任务)+ 指挥家(5种执行策略)+ 带回滚的验证状态机;治理型舰队路由,含排名专业匹配 | | 🛡️ 治理与安全 | 4级成熟度(学生→自主),策略门控的人机环路审批,全面的审计跟踪,AI 驱动的培训,OIDC SSO + SCIM v2 供应 + 8角色 RBAC | | ✅ 结果验证 | 后置条件预言机根据权威记录系统重新推导成功——默认启用,被驳回的自我报告被标记为 UNVERIFIED(ATOM_ORACLE_ENFORCE 紧急停止);两级置信度溯源(自我报告 vs 外部验证);可选的审阅者再委派循环 | | 🎚️ 知道何时询问的代理 | 每种操作类型根据其验证记录赢得无中断状态,在证据薄弱时持续询问(询问模式为安全失败),并在结果回归时自动丧失特权——只有通过保留的认证门(Brier ≤ 0.25, 拒绝覆盖率 ≥ 0.7)后,自主权才会放宽 | | 🏛️ 治理型代理团队 | 多代理舰队像人类组织一样失败——忽略指令、重复工作、无人负责。Atom 提供了对策:具有单一责任代理的委派合同、有时效的特权租赁(而非头衔)、利益冲突检测、贡献学分驱动毕业、可选的每日对齐扫描 | | 🧠 记忆与学习 | 每轮事实提取、2级召回(SQL + LanceDB)、情景记忆、memory_remember/forget、自我进化(Memento/AlphaEvolver,自我进化测试工具) | | 🔎 混合搜索 | documents.search 通过倒数排名融合(RRF)融合 BM25(FTS5/tsvector)+ 向量(LanceDB)——语义与精确检索结合,并附带引用 | | 🗂️ 知识虚拟文件系统 | 代理原生文档树——ls/cat/grep/search,带行号引用,而非为每个存储定制查询 | | 📻 代理无线电 | 代理之间横向点对点消息传递(提及优先,预算治理)——代理无需硬编码团队即可协调 | | 💼 Office 自动化 | 代理驱动的 Canvas 上 Excel/Word/PPTX 编辑,并实时预览广播;公式计算工作簿运行时;代理与文档同步 | | 🧩 小型应用 | 代理创建的有状态画布应用——Firecracker microVM 隔离,按实例聊天 | | 🔍 GraphRAG 与智能 | 多跳扩展、Leiden 社区检测、即时事实验证、D3 可视化探索器 | | 🌐 46+ 业务集成 | Salesforce, HubSpot, Slack, Teams, Gmail, Notion, Jira, Linear, Stripe, QuickBooks, Shopify, GitHub, GitLab, Zoom… | | 🛰️ LLM 网关 | 基于您的 BYOK 的 OpenAI/Anthropic 兼容 API——将 Claude Code, n8n 或任何 OpenAI-SDK 应用指向 Atom | | 💰 成本感知路由 | 5级认知分类、16+ 提供商、可选的学习路由器(基于反馈的重排序)、RTK token 压缩 | | 🤝 互操作性 | 用于外部工具服务器的 MCP 客户端、用于标准代理客户端的 ACP 端点、用于代理间委派的 A2A Agent Card + message/send、带可选 Langfuse 导出的 span 追踪 | | 🎯 目标驱动循环 | 代理根据 完成定义 谓词终止,而非总是运行到 max_steps;效用目标、自定义操作界面、卡顿检测 | — ## 🛡️ 生产就绪的安全性(默认启用) | 层级 | 您获得的能力 | |—|—| | 执行沙箱 | 文件系统范围、工具白名单、绊线、资源上限、KillRun——在每个工具分发中心强制执行(进程内策略检查);小型应用在 Firecracker microVM 中运行 | | 加密凭据 | OAuth 集成令牌静态加密(Fernet);生产环境中若无密钥则关闭 | | 每代理能力绑定 | 零信任工具作用域——代理永远不能超越其层级下限 | | 出口网守 | 速率限制、响应掩码、集成调用时的人机环路变更审批 | | 数据污点追踪 | 运行中观察到的受限数据会阻止外部出口操作 | | 外部 MCP 客户端 | 连接任意外部 MCP 服务器(Cloudflare 入口) | 安全架构 → · 沙箱深入剖析 → — ## 📚 文档与可发现性 | 入门 | 深入 | 指南 | |—|—|—| | 用户指南索引 ⭐ | 代理系统 | 快速开始 | | 文档索引 | 治理 | 用户指南 | | 环境变量 | 情景记忆 | 工作流自动化 | | 架构 | GraphRAG | 小型应用 | | | 上下文记忆 | Office 自动化 | | | 学习路由器 | 第三方集成 | | | LLM 网关 | OAuth 设置 | | | 混合搜索 · 知识虚拟文件系统 | 个人版 | | | 代理无线电 · 舰队编排 | 云部署 | | | 预言机验证 · 审阅者循环 | 代理环境 | | | 小型应用架构 | 沙箱层 | — ## 🎯 按部门划分的示例用例 | 部门 | 场景 | 关键集成 | |—|—|—| | 销售 | 新的 HubSpot 线索 → 研究公司 → 评分 → 创建 Asana 任务 → Slack 通知 | HubSpot, Asana, Slack, LinkedIn | | 财务 | Gmail PDF 发票 → OCR 提取 → QuickBooks 匹配 → 标记差异 | Gmail, QuickBooks, Excel, Slack | | 支持 | Zendesk 工单 → 情感分析 → 自动升级紧急工单 → 起草回复 | Zendesk, Slack, Email | | HR | BambooHR 新员工 → 配置账户 → 邀请加入 Slack → 安排入职 | BambooHR, Google Workspace, Slack, Calendar | | 工程 | GitHub PR → 运行测试 → 安全扫描 → 发布摘要 → 若通过则自动合并 | GitHub, GitLab, Slack, Jira | | 市场 | 内容日历 → 生成…

相似文章

研究如何构建LLM智能体框架

Reddit r/AI_Agents

这篇研究文章回顾了关于构建LLM智能体框架的研究成果,强调确定性护栏、有效的多智能体层次结构和适当的记忆架构对性能和安全至关重要,同时指出了当前评估和认证中的空白。

@Potatoloogs: https://x.com/Potatoloogs/status/2057391224592667051

X AI KOLs Timeline

本文深度拆解了Agent Harness的概念,即包裹在LLM外部的工程基础设施,包括编排循环、工具调用、记忆系统、上下文管理等12个组件。文章引用Anthropic、OpenAI、LangChain等公司的实践,论证了harness对生产级AI Agent的关键作用。

最好的智能代理工具会这样做……

Reddit r/AI_Agents

作者分享了构建高效智能代理工具的见解:最好的工具最大限度地减少对大语言模型(LLM)在琐碎任务上的依赖,将其保留用于复杂推理,从而将真正的代理工具与简单的包装器区分开来。

@janehu07: https://x.com/janehu07/status/2058359677843599494

X AI KOLs Timeline

本学习笔记介绍了智能体基础设施层的概念,将其定义为围绕LLM的基础设施层,提出了ETCLOVG分类法(执行、工具、上下文、生命周期、可观测性、验证、治理),并通过编码智能体案例研究展示了其应用。