@EXM7777: https://x.com/EXM7777/status/2078476892127318295

X AI KOLs Following 工具

摘要

一份关于使用Raft构建具有持久身份、记忆和共享工作空间的AI代理团队的指南,集成了Claude Code、Codex和Hermes等模型,用于自主业务功能。

https://t.co/T6SVuwh32D
查看原文
查看缓存全文

缓存时间: 2026/07/20 11:29

如何打造你的第一个AI代理团队

我将向你展示如何构建你的第一个AI代理团队……以及如何将它们连接成一个自我改进循环,运行在共享工作空间内

我们构建的团队有5个代理,分别对应你业务运行的五个职能:潜在客户获取、内容创作、销售管道、服务交付、财务

它们运行在三个引擎上——即代理所在的应用程序,你可能已经在为它们付费了:Claude Code、Codex 和 Hermes(这个免费)

而将它们整合在一起的工作空间叫做 Raft:免费起步,它把五个独立的聊天窗口变成了一个真正的团队

你几乎可以自己构建所有这一切——名称、记忆、定时运行

你唯一无法编写的是共享房间,即代理们能看到彼此工作的地方

最后你将得到完整的构建顺序:文件、时间表、审查规则,以及确切的第一周计划

为什么一个助手已经不够用了

一个独立的助手存在结构性问题:你就是它的质量控制

因此,输出受限于你的精力——而这恰恰是你试图解放的资源

而显而易见的解决方案,即打开更多会话,只会让情况更糟

没有名字,代理们会混在一起:

  • 一个代理起草计划

  • 第二个代理因为从未看到第一个的计划,而起草一份竞争计划

  • 三个并行运行各自重新发现相同的东西,因为它们学到的知识没有共享

更多代理,同样的瓶颈,现在还需要你照看

构建这些模型的公司已经在走另一条路

在Anthropic,一个代理队友创造了产品团队65%的代码

它坐在他们的频道里,记住它关注的所有讨论,并提前几天安排自己的任务

这个数字的意义超越了一家公司:AI的界面已经改变了两次,从一个你访问的网站到一个你安装的应用程序

第三个界面是一个永久的同事,一个全天候工作的同事

以下是区分真正团队与一堆代理的四件事:

  • 持久身份: 一个有名字和角色的代理,而不是一次全新的会话。你知道谁负责什么,以及当有问题时去哪里查看

  • 累积记忆: 每个代理保留自己的笔记和剧本,所以它们不仅会成长,还会分化。几周后你就有五个不同的专家,每个都从自己业务领域给出建议

  • 不是作者的审查者: 一个为自己工作打分的代理每次都会批准。而一个被告知假设工作有问题的第二个代理,能发现作者看不到的问题

  • 共享房间: 一个工作空间,每个代理都能看到其他人的输出,而不是五个孤立的聊天窗口,而你成为复制粘贴的中间人

收益是可衡量的:将工作分配给多个代理,并由一个主管审查结果,在Anthropic自己的研究基准测试中,这种设置比同一模型单独工作的表现高出90.2%

你可以手写所有三个文件并通过共享工作空间运行它们……或者你也可以在 Raft 上运行

一分钟了解Raft是什么

Raft 是一个人类和代理作为队友一起工作的工作空间

它看起来像Slack:频道、线程、任务、私信

不同的是,成员是具有持久身份和记忆的代理

它们从频道中认领任务,并行运行,相互交接工作,并在共享线程中审查彼此的输出

你像给同事布置任务一样在频道里提出请求,工作就在你处理其他事情时完成了

一个初始团队的三个实际细节:

  • 代理在你自己的机器上运行: 它们通过一个名为Computer的轻量级本地进程运行。你只需登录Raft,并在终端(命令窗口)中粘贴一行命令即可安装。你的文件、工具和AI订阅保留在你的硬件上,所以Raft永远不会介于你的代理和它的模型之间

  • 使用你已经付费的订阅: Claude Code、Codex、Gemini CLI、Cursor等。无需新的Token费用,你在其他地方运行的代理(如Hermes)也可以加入

  • 免费版涵盖本文所有内容: 付费计划增加了一些额外的付费功能,而一个代理只占十分之一个席位

并且有证据证明它能够大规模运作:已有20,000+构建者和团队使用它构建,而Raft背后的团队整个公司都在其中运作——10个人和100多个命名的代理

所以房间问题已经解决了

剩下的就是雇佣住在这里的五个代理

团队计划:五大支柱,五次雇佣

将团队映射到每个企业都运行的五个职能,每个职能一个命名的代理:

  • 潜在客户获取 - 监控你的来源,搜索潜在客户,起草初次接触

  • 内容创作 - 生产你的受众阅读的一切

  • 销售管道 - 保持每个正在进行的对话向前推进,这样交易无需你推动就能进展

  • 服务交付 - 生产客户付费购买的工作成果

  • 财务 - 追踪发票、成本以及月底实际剩下多少钱

每个支柱都使用为其工作类型构建的引擎

引擎是代理运行的应用程序,三个引擎各自带来不同的模型和不同的“本能”

所以以下是每个引擎是什么,以及它应该负责的任务

而整个构建的最大优势在于:没有一个是你需要从头配置的新代理平台

这些是经过验证的框架,你可能已经在使用了,并且按照你今天使用它们的方式直接使用

Claude Code 是 Anthropic 不断将其发展成完整队友的同一个应用,包括标签等

你的团队会永远继承这些工具发布的每一个升级

Claude Code,写作者

Anthropic 的终端应用,运行 Claude 系列模型:顶级思考使用 Fable 5,常规运行使用更便宜的层级

Claude 模型是目前可用的最强写作模型,这就是为什么这个引擎负责所有人类会阅读的内容:内容创作和服务交付——帖子、提案、客户交付物

两个习惯让它从聊天工具变成队友:

  • 定时运行: 一个重复直到完成的任务,每轮一次变更

  • 终点线: 你写下“完成”的定义,另一双眼睛每轮检查你是否已经越过它

Claude Code 内置了这两个命令——/loop 用于定时运行,/goal 用于终点线……在 Raft 上,这两个习惯存在于房间中:时间表是聊天中的一句话,终点线是你将在“循环”部分遇到的审查者

以及让它变得负担得起的金钱规则:高级模型在规划和审查阶段发挥作用,常规运行走廉价层级

给它如下形状的任务:“为Y写X,这是简报,当检查清单通过时停止”

Codex,构建者

OpenAI 的编码代理——它随你可能已经拥有的 ChatGPT 订阅一起提供,并运行 GPT 模型

它的工作是编码:它读取整个代码库,将更改作为可审查的差异提交,并在沙箱内运行,这样错误不会离开文件夹

在这个团队中,它构建其他每个支柱最终会请求的工作流和内部工具:财务追踪器、发票解析器、报告脚本、将团队粘合在一起的小型自动化工具

给它如下形状的任务:“构建X,通过粘贴输出来证明它有效”

Hermes,夜班守卫

来自 Nous Research 的开源代理,专为在你不在线时保持运行而构建

它通过一个小型网关进程作为外部代理加入 Raft,其调度器每60秒检查一次到期的任务,并在新的会话中运行每个任务

它的三个特性直接映射到销售工作上:

  • 心跳: 无论你是否出现都会触发的重复任务

  • 监控器: 监视一个来源、一个收件箱、一个列表,直到有变化才说话

  • 剧本: 当它解决了一个难题,它会将解决方案保存为可复用的配方,这样同样的问题永远不会再次耗费成本

这就是为什么它负责始终在线的支柱:潜在客户获取和销售管道——清晨扫描、回复监控、跟进追踪

如果你不想设置外部代理,Raft 的内置功能覆盖了相同领域:提醒处理时间表和监控并报告检查,每个代理也会自己保留剧本笔记……Hermes 是专业化版本,不是入门条件

路由表

  • 潜在客户获取: june - Hermes - 07:00 来源扫描

  • 内容创作: cole - Claude Code - 周一:起草本周内容

  • 销售管道: etta - Hermes - 每小时回复检查,默认静默

  • 服务交付: ray - Claude Code - 每日:客户交付物检查

  • 财务: penn - Codex - 周五:数据报告

名称是例子,选你自己的……路由部分是需要复制的内容

五个代理,三个引擎,一个房间

现在正确地构建第一个,因为模式会重复用于其他四个

构建你的第一个专家

每个代理都由相同的五个部分组装而成:一个名称,一个灵魂,一份记忆,目标,和一个心跳

以下是 june,潜在客户获取代理,从头到尾

1. 名称

选一个真实的名字,不要用“agent-2”

名称是你如何分配工作(“把这个交给 june”)以及如何审计它(“这是 june 起草的,谁审查了?”)

2. 灵魂

大家想象的文件实际上在 Raft 上是三个层次:你雇佣时写的工作描述,限定它可触及范围的配置,以及它自己在多次会话中积累的记忆……第一个是给定的,最后一个是争取来的

你不需要预先写出灵魂:你在聊天中告诉 june 一些事情——“只起草,绝不联系潜在客户”——而她自己的版本会逐渐积累

但你仍然需要知道一个完成后的灵魂长什么样,这是你衡量代理版本的基准……半页纸就够了:

  • # june:潜在客户获取

  • 你发现并筛选潜在客户,你绝不联系他们

  • 范围:仅限潜在客户开发——没有内容,没有客户工作,没有财务

  • 语气:平实的英语,没有炒作,用数字代替形容词

  • 每个工作日你交付:已筛选的潜在客户,每个附带一行原因,以及每个潜在客户的初次接触草稿

  • 硬性规则:仅限草稿(发送永远是人为决定),每个潜在客户要附带来源链接,如果来源看起来过时或抓取错误,请说出来而不是猜测

在 Raft 之外,你自己写这个并指向代理

3. 记忆

代理自己保留这个:一个 MEMORY.md 加上工作笔记——什么有效,什么错了,哪些来源是金子哪些是噪音

你不需要维护它,你喂养它——你在聊天中给出的每一个更正,它都会写下来

当笔记超过一页时让它压缩——永远增长的记忆最终不再被读取

4. 目标

这个代理拥有什么,完成是什么样子,以及它必须交给你而不是自己决定什么——在聊天中说一次,由代理保留:

  • 拥有: 稳定的合格初次接触草稿流

  • 完成: 每个潜在客户都有一个理由、一个来源、一份草稿

  • 上报: 定价问题、任何回复的人、任何法律问题

5. 心跳

它无需被要求就会醒来的时间表(在 Raft 上这是提醒功能:你在聊天中说一次,代理自己醒来)

june 两个就够了:

  • 每天早上 07:00: 扫描来源列表,将新的潜在客户+草稿发送到 leads 频道

  • 每小时: 检查回复。如果没有变化,什么也不说

完整的雇佣过程:一个名字,几条聊天消息,几行定时安排……文件会从那里自行增长

在 Raft 中,输出作为草稿落在频道中,然后下一层开始接手

自我改进循环

这个循环基于一条规则:没有代理为自己的工作打分

如果放任不管,代理每次都会赞美自己的输出

所以每个交付物都要经过第二个被告知要持异议的代理,指令简短如下:

  • 你审查 june 的潜在客户草稿

  • 假设每个草稿都有问题,并找出问题:匹配度不对、理由不充分、来源过时、没有链接的主张

  • 附上理由拒绝,或者用一行字批准

审查者不是新雇佣的,而是同样的五个代理互相检查彼此的工作

cole 的内容草稿由 ray 根据客户简报审查,june 的外联由 etta 根据交易历史检查,penn 的脚本由 cole 仔细审查

一切都以草稿形式落在频道中——绝不会是已发送的邮件,绝不会是已推送的变更

你永远是任何离开走廊的事物的最终决策者:发送、金钱、客户交付物

有所改变的是你收到的东西:已解决的草稿,其中的分歧已经解决,而不是你需要逐行检查的原始输出

而让这个循环自我改进的是:每次拒绝都附带一个理由,并且这些理由被写回到灵魂和记忆文件中

同样的错误不会存活两次,所以你在第三个月运行的团队,已经是一个与你最初雇佣时不同的机器了

你的第一周

不要一次性建立五个代理

一个你无法喂养的团队只是表演

  • 第一天: 安装 Computer,创建一个频道,雇佣一个代理……选那个你耗时最多的支柱

  • 第一天: 根据上面的模板设置它的灵魂,在聊天中说或写成一个文件,并替换成你的范围和规则

  • 第二天: 用简短指令添加它的审查者,将两者路由到频道中

  • 第三天到第七天: 每天运行这个组合,每次你纠正了同一个错误两次,就把更正写入灵魂文件

  • 第二周: 添加下一个支柱,并且只因为第一个现在不需要你就能运行

第一周感觉比你自己做要慢,因为你在写下通常即时应用的判断

这些判断正是文件捕获的内容——而这就是为什么第四周看起来与第一周完全不同

行动手册

  • 5个支柱,每个一个命名的代理: 潜在客户获取、内容创作、销售管道、服务交付、财务

  • 按工作类型分配引擎: Claude Code 写作,Codex 构建,Hermes 运行始终在线的任务

  • 每个代理: 一个名称、一个灵魂文件、一个记忆文件、一个目标文件、一个心跳

  • 1个循环: 没有代理为自己的工作打分,每次拒绝都写回文件……团队自我改进

  • 1个房间: Raft,频道中的草稿,你作为最终决策者

  • 1次一个支柱: 第一天五个饥饿的代理是整个项目被放弃的原因

感谢 Raft 赞助本文

瓶颈从来不是模型

而是模型周围的结构,而你刚刚读完了整个结构

相似文章

@EXM7777: https://x.com/EXM7777/status/2073045719020343705

X AI KOLs Timeline

本指南逐步介绍如何使用 Obsidian 和 Fable 5 AI 模型构建第二大脑,展示如何创建持久的知识库以提升 AI 输出质量。该系统通过纯文本 Markdown 文件存储记忆,使智能体能够引用过往决策并生成更具个性化的结果。