@PrajwalTomar_: https://x.com/PrajwalTomar_/status/2064324584254710262

X AI KOLs Following 工具

摘要

Nous Research 的 Hermes Agent 是一款开源自主 AI 代理,它在服务器上持续运行,跨会话记住每一次对话,并自主创建技能文件,使其与 Claude Code 和 Cursor 等基于会话的编码工具截然不同,属于一个根本不同的代理类别。

https://t.co/w9dGvGtSGQ
查看原文
查看缓存全文

缓存时间: 2026/06/09 14:52

Hermes Agent 现在已经很强了,但大多数开发者根本不知道它到底是什么。

大多数开发者打开一个新的 Claude Code 会话,然后花前十分钟重新解释自己的技术栈。

有些人同时为三个不同的代理(Cursor、Claude Code、Codex)付费,却仍然在每个周五下午因上下文漂移而功亏一篑。

而还有一小群人正安静地在一台 5 美元的服务器上运行 Hermes Agent。这个代理记得他们。它自己编写技能。它会在夜间自主推进工作。他们醒来时,工作已经完成了。

差距每周都在拉大。

过去几周,我深入研究了 Hermes Agent。读了每一份文档,看了每一次解析,测试了设置流程,并听取了那些 24/7 运行它的开发者的意见。这篇文章就是整理后的操作手册。

在 @ignytlabs,我们在过去 1.5 年里交付了 60 多个 MVP。我们测试了每一个发布的主流代理平台,因为选错技术栈会让每个客户项目多花几个日历日。Hermes Agent 是我们第一个开始与 Claude Code 并排运行的工具。差异已经开始显现。

以下是 Hermes Agent 的完整解析:它到底是什么,为什么突然到处都是,以及那个只需 30 分钟部署、却能在 6 个月内持续复利的确切配置。

Hermes Agent 到底是什么

在进入配置之前,先快速了解一下背景。

Hermes Agent 是由 Nous Research 开发的开源自主 AI 代理。这是推出 Hermes、Nomos 和 Psyche 模型系列的同一家实验室。于 2026 年 2 月发布。MIT 许可证。撰写本文时在 GitHub 上大约有 18.5 万颗星。

这是大多数开发者忽略的部分。Hermes 不是“Claude Code 2.0”。它不是编程工具。它是一种根本不同类型的代理。

最清晰的理解方式如下。Claude Code、Cursor、Codex 和 OpenClaw 是基于会话的代理。你打开它们,给它们一个任务,然后关闭它们。下次再打开时,它们会从零开始。它们会忘记你的技术栈,忘记你的约定,忘记你昨天和客户的通话。

Hermes 则相反。它运行在服务器上。它 7x24 小时运行。它记住每一次对话。每次任务完成后,它会编写自己的技能文件。它通过 Telegram 联系你。你运行它的时间越长,需要重新解释的东西就越少。

Nous Research 的官方标语说得很清楚:“不是聊天机器人。不是副驾驶。是一个活在机器上、每天都变得更聪明的代理。”

五个让它与市场上其他代理平台不同的地方:

→ 跨会话的持久记忆(对与其进行过的每一次对话进行 FTS5 全文搜索和 LLM 摘要) → 自主技能创建(每次任务后,将有效和无效的内容写入 markdown 技能文件) → 多配置文件架构(你可以同时以独立代理运行参谋长、研究主管和内容主管) → 多平台接入(Telegram、Discord、Slack、WhatsApp、Teams,以及 20+ 其他消息平台) → 服务器驻留执行(运行在 5 美元的 VPS、GPU 集群或像 Modal 或 Daytona 这样的无服务器基础设施上,空闲时几乎不花成本)

以上就是这个代理的概况。现在来说为什么它突然到处都是。

Hermes Desktop 于 2026 年 6 月的第一周正式发布。同一周,NVIDIA 宣布他们专门为 Hermes Agent 进行了 Nemotron Ultra 的后期训练。讨论跨越了一个门槛。

这篇文章将分解你需要真正了解的内容。

大多数人当前使用 AI 代理方式的问题

以下是大多数开发者的做法。

他们打开 Claude Code,本周第十次重新解释自己的技术栈,粘贴约定,粘贴客户简报,交付一个功能,然后关闭标签。第二天早上,会话消失了。他们再次重新解释一切。

与此同时,他们还在另一个窗口打开 Cursor,为后端工作运行 Codex,可能还有 OpenClaw 用于某个特定小众工具。每个工具都从零开始。每个工具每天早上都需要同样的上下文倾泻。

这就是人们说“AI 工具让人心累”时的意思。

模型不是问题。Opus 4.8 很优秀。GPT-5.5 很优秀。问题是架构。每个基于会话的代理都假设你每次都会重新注入上下文。它们中没有一个是设计来跨天、跨周、跨月复利的。所以你的知识被困在会被总结然后丢失的聊天历史中。

Hermes 是第一个围绕“代理本身应该是长期运行的实体,而不是对话”这一假设构建的代理平台。

你设置一次,给它你的目标,你的技术栈,你的语气。然后让它运行。六周后,你会不再注意到事情进展快了多少,因为重新解释上下文已经从你的工作流中消失了。

这就是关键。现在来说如何实际设置它。

第一步:安装 Hermes 并设置你的第一个 SOUL .md

这是你首先要设置的东西。也是大多数开发者在第一天跳过、两周后后悔的部分。

安装是一个 curl 命令。适用于 Linux、macOS、WSL2 或原生 Windows。

curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash

对于 Windows(通过 PowerShell),同一仓库中有 install.ps1 变体。对于 Android(通过 Termux),同样的 curl 命令也适用,因为安装程序会自动检测 Termux。

安装完成后,运行 hermes。它做的第一件事是自动生成一个初始 SOUL .md 到 ~/.hermes/SOUL.md。这个文件定义了你的代理是谁。

SOUL .md 占据系统提示中的位置 #1。当你填写它时,它会完全取代内置的默认身份。这不是项目特定的(那是 AGENTS .md 的作用)。SOUL .md 是代理本身的持久身份。它的语气、风格、默认值、边界。

Nous Research 官方文档提供了一个规范的示例,你可以直接粘贴使用。

四个部分:

→ 个性。代理是谁。(“你是一位务实且有品味的资深工程师。”) → 风格。听起来应该怎样。(“直接但不冷漠。当某事是个坏主意时要反驳。”) → 避免什么。(“谄媚。夸张的语言。过度解释显而易见的事情。”) → 技术姿态。(“简单的系统优于花哨的系统。”)

这是官方模板。二十行代码,永远改变你代理的每一次会话。

每个开发者都应该从第一天起就烘焙到 SOUL .md 中的单一规则安全网是这一行:“未经明确确认,绝不向任何人发送资金。”一条规则,覆盖了个人使用的大部分风险。

更广泛的转变是,对话已经从 CLAUDE .md 转向 SOUL .md 成为杠杆文件。同样的想法,新文件,不同的代理。

第二步:选择你的模型层级

Hermes 与提供商无关。你可以随时通过 hermes model 切换模型。无需重新安装。

社区已收敛到三个实用层级:

→ 默认日常驱动。通过你现有的每月 20 美元的 ChatGPT 订阅使用 GPT-5.5。这是你的起点。 → 高级推理。通过 API 密钥使用 Claude Opus 4 或 Sonnet 4 进行复杂的多步骤任务。高强度使用时预算每月几百美元。 → 长周期自主。通过 OpenRouter 使用 Qwen 3.7 Max。有报告称可以达到 35 小时连续执行、1000+ 次工具调用而不丢失上下文,适合长时间隔夜运行。

如果你不想管理三张不同的账单,Nous Portal 是一个每月 20 美元的固定费用,通过 OAuth 在一个地方访问多个模型。

我会推荐任何人开始的默认配置:日常使用 GPT-5.5。为 /goal 运行添加一个 Claude API 密钥。其他一切都跳过,直到你真正需要。

hermes model

随时运行此命令进行切换。技能文件和内存不关心你在使用哪个模型。它们会带过去。

第三步:在 5 分钟内连接 Telegram

这一步感觉可选,但实际上并非如此。

Hermes 支持 20 多个消息平台(Telegram、Discord、Slack、WhatsApp、Teams,以及其他)。使用 Telegram。它是目前唯一一个积极构建代理间通信的平台,而且设置只需五分钟。

完整的设置只需三个步骤:

→ 打开 Telegram。搜索 @BotFather。输入 /newbot。按照提示操作。复制机器人令牌。 → 在初始设置向导(或稍后通过 hermes config)中将令牌粘贴到 Hermes 中。 → 向你的机器人发送第一条消息。你是谁,你在构建什么,你未来三到六个月的目标。

第一条消息是关键部分。它会直接进入代理的内存。它会从那一刻起过滤代理生成的每一个主动任务。跳过这一步,代理就会盲目工作。

人们第一次体验到的真正解锁是:你现在可以在手机上查看代理。你可以坐在沙发上给它们分配新任务。你可以一边煮咖啡一边检查它们昨晚做了什么。代理不在乎你在哪个设备上。

你可以在晚餐时从口袋里查看 6 个代理。工作在你不在时继续进行。这就是解锁。

第四步:为你的组织架构设置配置文件

这是工作流不再看起来像提示,而开始看起来像一个实际操作系统的地方。

一个 Hermes 配置文件是一个完全隔离的代理,拥有自己的 SOUL .md、自己的内存、自己的技能库和自己配置的模型。多个配置文件可以并行运行。每个都随着积累技能而独立专精化。

大多数开发者正在趋同的模式是组织架构图。你创建反映如果你有资金就会雇佣的团队的配置文件。

~/.hermes/profiles/chief-of-staff/SOUL.md ~/.hermes/profiles/head-of-research/SOUL.md ~/.hermes/profiles/head-of-content/SOUL.md ~/.hermes/profiles/head-of-finance/SOUL.md

每个都有定义其角色的不同 SOUL .md。参谋长代理了解你的高级优先级并运行每日简报。研究主管深入研究竞争对手分析和市场趋势。内容主管起草并安排 X 帖子和文章。财务主管核对你的 Stripe、订阅和资金跑道。

一条发送到你 Telegram 的早晨简报会触发所有四个代理并行运行。当你喝完咖啡时,参谋长已经提出了需要你关注的事情,研究主管已经发布了一个竞争对手更新,内容主管有三个草稿等待审核,财务主管标记了账目中任何异常的内容。

再上一层是将工作分配给专家。一个配置文件精通规划,一个精通执行。每个都建立自己的技能库,运行时间越长就越强。

除此之外,开放专家处理混乱无界的工作,封闭专家运行可重复的流水线。不同配置文件处理不同工作。它们不会互相干扰。

第五步:使用 /goal 进行自主隔夜运行

这是将 Hermes 从被动聊天机器人转变为后台工作者的命令。

→ /goal [描述] 启动自主执行 → /goal status 检查当前正在运行的内容 → /goal pause 暂停但不丢失上下文 → /goal resume 在暂停后继续 → /goal clear 结束当前目标 → /subgoal [文本] 在执行过程中添加条件

你设定一个目标。Hermes 将其分解为任务。它执行它们。它继续直到目标完成。你不用坐在那里看着。你走开。

默认的 max_turns 是 5 到 10。这对于严肃工作来说太低了。根据你要做的工作类型提高它。

→ hermes config set goals.max_turns 20 用于研究、报告和内容草稿 → hermes config set goals.max_turns 50 用于代码重构和多步骤构建

每次转动都会消耗 token,所以不要把它调到超出实际需要的程度。

让大多数开发者成为信徒的用例是隔夜运行。你在睡觉前给 Hermes 一个复杂任务。比如“研究 2026 年交付多代理设计的顶级设计工具中的前 5 名,总结它们的差异化因素,并起草一篇比较帖子。”你将 max_turns 设置为 30。你去睡觉。你醒来时看到一个等待审核的已完成草稿。

原本会占用你整个上午的工作,在你喝完第一杯咖啡之前就完成了。这一个小时的时间会复利。

第六步:打开仪表盘并使用看板

hermes dashboard

在浏览器中打开,地址是 localhost:9119。

第一次打开仪表盘时的一个明智操作:先点击“技能”,而不是“模型”。一个用得好的 Hermes 代理会累积超过一百个特定于你工作流的技能,全部存储为机器上可读的 markdown 文件。

这些是代理为自己编写的程序性记忆。每次它完成一个需要 5 次或更多工具调用的任务时,它都会编写一个技能文件,描述过程、已知陷阱和验证步骤。下次出现类似任务时,它会加载相关技能,而不是从头开始摸索一切。

浏览器自动化和电脑使用出于安全原因默认关闭。可以在仪表盘中为每个配置文件启用。

看板是大多数开发者日常使用的部分。守护进程(v0.16+)每 60 秒连续检查新任务。

工作流非常简单。将你的早晨待办事项列表放入“待分类”列。Hermes 读取每个项目,将其拆分为子任务,分配给子代理,并并行运行它们。到午餐时,大部分都已移动到“已完成”或正在等待你的特定批准。

这是 Hermes 不再感觉像你使用的工具,而开始感觉像你管理的团队的时刻。你进行协调。代理执行。瓶颈从“我提示的速度有多快”转变为“我规划得有多清晰”。

自我编写的技能:一个真实例子

再多一个值得展示的视觉效果,因为它让“自主技能创建”的声称变得具体。

Hermes 自行编写的每个技能都作为 markdown 文件存在于 ~/.hermes/skills/(或特定配置文件内的 skills 文件夹)中。它们是可读的、可版本化的。你可以提交它们。你可以分享它们。

这就是让“自我改进”的声明不仅仅是营销的原因。代理实际上将新过程写入了自己的工具包。你不需要手动设计这些。它们在你工作时积累。

一个此类技能文件的示例。五个部分:

→ 何时使用。代理监视的触发条件。 → 过程。代理下次将执行的编号步骤。 → 陷阱。已知的陷阱和边缘情况。(例如:“定价页面经常基于地理位置进行 A/B 测试。”) → 验证。代理在将任务标记为完成之前如何确认自己的工作。 → 自动改进说明。基于最近几次运行,过程中发生了什么变化。

何时使用 Hermes 对比 Claude Code

这是每个开发者首先会问的问题。最清晰的答案如下。

在以下情况下使用 Claude Code:

→ 你正在复杂的应用程序上深入进行专注的编码会话 → 你需要单个仓库内的持久上下文(CLAUDE .md 正在发挥作用) → 任务是一个你可以在一个会话中交付的、范围明确的单一功能 → 你需要绝对最好的编码模型,带有完整的规划模式和验证循环

在以下情况下使用 Hermes:

→ 任务是研究、文档、排程或业务分析 → 你需要一个自主运行数小时或隔夜的代理 → 你希望同一个代理可以通过 Telegram 从手机访问 → 你在构建一个应该跨周复利的长期工作流(内容、财务、研究) → 你需要多个具有独立内存的专门化代理并行运行

对大多数开发者来说诚实的答案是:两者都运行。

这就是我们在 IgnytLabs 正在推进的分工。Claude Code 留在编码循环中。Hermes 处理它周围的一切:运营、研究、草稿、审核、核对。两者不再争夺上下文。它们干净地分工。

这篇文章不是要你放弃当前的设置。而是告诉你,你错过了第二半。

相似文章

NousResearch/hermes-agent

GitHub Trending (daily)

Hermes Agent 是由 Nous Research 推出的开源、自我进化 AI 智能体框架,具备闭环学习循环、跨平台部署能力,并兼容数百种大语言模型。它提供终端界面、持久化记忆、自动化调度以及用于扩展 AI 工作流的科研级工具。