@PrajwalTomar_: https://x.com/PrajwalTomar_/status/2064324584254710262
摘要
Nous Research 的 Hermes Agent 是一款开源自主 AI 代理,它在服务器上持续运行,跨会话记住每一次对话,并自主创建技能文件,使其与 Claude Code 和 Cursor 等基于会话的编码工具截然不同,属于一个根本不同的代理类别。
查看缓存全文
缓存时间: 2026/06/09 14:52
Hermes Agent 现在已经很强了,但大多数开发者根本不知道它到底是什么。
大多数开发者打开一个新的 Claude Code 会话,然后花前十分钟重新解释自己的技术栈。
有些人同时为三个不同的代理(Cursor、Claude Code、Codex)付费,却仍然在每个周五下午因上下文漂移而功亏一篑。
而还有一小群人正安静地在一台 5 美元的服务器上运行 Hermes Agent。这个代理记得他们。它自己编写技能。它会在夜间自主推进工作。他们醒来时,工作已经完成了。
差距每周都在拉大。
过去几周,我深入研究了 Hermes Agent。读了每一份文档,看了每一次解析,测试了设置流程,并听取了那些 24/7 运行它的开发者的意见。这篇文章就是整理后的操作手册。
在 @ignytlabs,我们在过去 1.5 年里交付了 60 多个 MVP。我们测试了每一个发布的主流代理平台,因为选错技术栈会让每个客户项目多花几个日历日。Hermes Agent 是我们第一个开始与 Claude Code 并排运行的工具。差异已经开始显现。
以下是 Hermes Agent 的完整解析:它到底是什么,为什么突然到处都是,以及那个只需 30 分钟部署、却能在 6 个月内持续复利的确切配置。
Hermes Agent 到底是什么
在进入配置之前,先快速了解一下背景。
Hermes Agent 是由 Nous Research 开发的开源自主 AI 代理。这是推出 Hermes、Nomos 和 Psyche 模型系列的同一家实验室。于 2026 年 2 月发布。MIT 许可证。撰写本文时在 GitHub 上大约有 18.5 万颗星。
这是大多数开发者忽略的部分。Hermes 不是“Claude Code 2.0”。它不是编程工具。它是一种根本不同类型的代理。
最清晰的理解方式如下。Claude Code、Cursor、Codex 和 OpenClaw 是基于会话的代理。你打开它们,给它们一个任务,然后关闭它们。下次再打开时,它们会从零开始。它们会忘记你的技术栈,忘记你的约定,忘记你昨天和客户的通话。
Hermes 则相反。它运行在服务器上。它 7x24 小时运行。它记住每一次对话。每次任务完成后,它会编写自己的技能文件。它通过 Telegram 联系你。你运行它的时间越长,需要重新解释的东西就越少。
Nous Research 的官方标语说得很清楚:“不是聊天机器人。不是副驾驶。是一个活在机器上、每天都变得更聪明的代理。”
五个让它与市场上其他代理平台不同的地方:
→ 跨会话的持久记忆(对与其进行过的每一次对话进行 FTS5 全文搜索和 LLM 摘要) → 自主技能创建(每次任务后,将有效和无效的内容写入 markdown 技能文件) → 多配置文件架构(你可以同时以独立代理运行参谋长、研究主管和内容主管) → 多平台接入(Telegram、Discord、Slack、WhatsApp、Teams,以及 20+ 其他消息平台) → 服务器驻留执行(运行在 5 美元的 VPS、GPU 集群或像 Modal 或 Daytona 这样的无服务器基础设施上,空闲时几乎不花成本)
以上就是这个代理的概况。现在来说为什么它突然到处都是。
Hermes Desktop 于 2026 年 6 月的第一周正式发布。同一周,NVIDIA 宣布他们专门为 Hermes Agent 进行了 Nemotron Ultra 的后期训练。讨论跨越了一个门槛。
这篇文章将分解你需要真正了解的内容。
大多数人当前使用 AI 代理方式的问题
以下是大多数开发者的做法。
他们打开 Claude Code,本周第十次重新解释自己的技术栈,粘贴约定,粘贴客户简报,交付一个功能,然后关闭标签。第二天早上,会话消失了。他们再次重新解释一切。
与此同时,他们还在另一个窗口打开 Cursor,为后端工作运行 Codex,可能还有 OpenClaw 用于某个特定小众工具。每个工具都从零开始。每个工具每天早上都需要同样的上下文倾泻。
这就是人们说“AI 工具让人心累”时的意思。
模型不是问题。Opus 4.8 很优秀。GPT-5.5 很优秀。问题是架构。每个基于会话的代理都假设你每次都会重新注入上下文。它们中没有一个是设计来跨天、跨周、跨月复利的。所以你的知识被困在会被总结然后丢失的聊天历史中。
Hermes 是第一个围绕“代理本身应该是长期运行的实体,而不是对话”这一假设构建的代理平台。
你设置一次,给它你的目标,你的技术栈,你的语气。然后让它运行。六周后,你会不再注意到事情进展快了多少,因为重新解释上下文已经从你的工作流中消失了。
这就是关键。现在来说如何实际设置它。
第一步:安装 Hermes 并设置你的第一个 SOUL .md
这是你首先要设置的东西。也是大多数开发者在第一天跳过、两周后后悔的部分。
安装是一个 curl 命令。适用于 Linux、macOS、WSL2 或原生 Windows。
curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash
对于 Windows(通过 PowerShell),同一仓库中有 install.ps1 变体。对于 Android(通过 Termux),同样的 curl 命令也适用,因为安装程序会自动检测 Termux。
安装完成后,运行 hermes。它做的第一件事是自动生成一个初始 SOUL .md 到 ~/.hermes/SOUL.md。这个文件定义了你的代理是谁。
SOUL .md 占据系统提示中的位置 #1。当你填写它时,它会完全取代内置的默认身份。这不是项目特定的(那是 AGENTS .md 的作用)。SOUL .md 是代理本身的持久身份。它的语气、风格、默认值、边界。
Nous Research 官方文档提供了一个规范的示例,你可以直接粘贴使用。
四个部分:
→ 个性。代理是谁。(“你是一位务实且有品味的资深工程师。”) → 风格。听起来应该怎样。(“直接但不冷漠。当某事是个坏主意时要反驳。”) → 避免什么。(“谄媚。夸张的语言。过度解释显而易见的事情。”) → 技术姿态。(“简单的系统优于花哨的系统。”)
这是官方模板。二十行代码,永远改变你代理的每一次会话。
每个开发者都应该从第一天起就烘焙到 SOUL .md 中的单一规则安全网是这一行:“未经明确确认,绝不向任何人发送资金。”一条规则,覆盖了个人使用的大部分风险。
更广泛的转变是,对话已经从 CLAUDE .md 转向 SOUL .md 成为杠杆文件。同样的想法,新文件,不同的代理。
第二步:选择你的模型层级
Hermes 与提供商无关。你可以随时通过 hermes model 切换模型。无需重新安装。
社区已收敛到三个实用层级:
→ 默认日常驱动。通过你现有的每月 20 美元的 ChatGPT 订阅使用 GPT-5.5。这是你的起点。 → 高级推理。通过 API 密钥使用 Claude Opus 4 或 Sonnet 4 进行复杂的多步骤任务。高强度使用时预算每月几百美元。 → 长周期自主。通过 OpenRouter 使用 Qwen 3.7 Max。有报告称可以达到 35 小时连续执行、1000+ 次工具调用而不丢失上下文,适合长时间隔夜运行。
如果你不想管理三张不同的账单,Nous Portal 是一个每月 20 美元的固定费用,通过 OAuth 在一个地方访问多个模型。
我会推荐任何人开始的默认配置:日常使用 GPT-5.5。为 /goal 运行添加一个 Claude API 密钥。其他一切都跳过,直到你真正需要。
hermes model
随时运行此命令进行切换。技能文件和内存不关心你在使用哪个模型。它们会带过去。
第三步:在 5 分钟内连接 Telegram
这一步感觉可选,但实际上并非如此。
Hermes 支持 20 多个消息平台(Telegram、Discord、Slack、WhatsApp、Teams,以及其他)。使用 Telegram。它是目前唯一一个积极构建代理间通信的平台,而且设置只需五分钟。
完整的设置只需三个步骤:
→ 打开 Telegram。搜索 @BotFather。输入 /newbot。按照提示操作。复制机器人令牌。
→ 在初始设置向导(或稍后通过 hermes config)中将令牌粘贴到 Hermes 中。
→ 向你的机器人发送第一条消息。你是谁,你在构建什么,你未来三到六个月的目标。
第一条消息是关键部分。它会直接进入代理的内存。它会从那一刻起过滤代理生成的每一个主动任务。跳过这一步,代理就会盲目工作。
人们第一次体验到的真正解锁是:你现在可以在手机上查看代理。你可以坐在沙发上给它们分配新任务。你可以一边煮咖啡一边检查它们昨晚做了什么。代理不在乎你在哪个设备上。
你可以在晚餐时从口袋里查看 6 个代理。工作在你不在时继续进行。这就是解锁。
第四步:为你的组织架构设置配置文件
这是工作流不再看起来像提示,而开始看起来像一个实际操作系统的地方。
一个 Hermes 配置文件是一个完全隔离的代理,拥有自己的 SOUL .md、自己的内存、自己的技能库和自己配置的模型。多个配置文件可以并行运行。每个都随着积累技能而独立专精化。
大多数开发者正在趋同的模式是组织架构图。你创建反映如果你有资金就会雇佣的团队的配置文件。
~/.hermes/profiles/chief-of-staff/SOUL.md ~/.hermes/profiles/head-of-research/SOUL.md ~/.hermes/profiles/head-of-content/SOUL.md ~/.hermes/profiles/head-of-finance/SOUL.md
每个都有定义其角色的不同 SOUL .md。参谋长代理了解你的高级优先级并运行每日简报。研究主管深入研究竞争对手分析和市场趋势。内容主管起草并安排 X 帖子和文章。财务主管核对你的 Stripe、订阅和资金跑道。
一条发送到你 Telegram 的早晨简报会触发所有四个代理并行运行。当你喝完咖啡时,参谋长已经提出了需要你关注的事情,研究主管已经发布了一个竞争对手更新,内容主管有三个草稿等待审核,财务主管标记了账目中任何异常的内容。
再上一层是将工作分配给专家。一个配置文件精通规划,一个精通执行。每个都建立自己的技能库,运行时间越长就越强。
除此之外,开放专家处理混乱无界的工作,封闭专家运行可重复的流水线。不同配置文件处理不同工作。它们不会互相干扰。
第五步:使用 /goal 进行自主隔夜运行
这是将 Hermes 从被动聊天机器人转变为后台工作者的命令。
→ /goal [描述] 启动自主执行 → /goal status 检查当前正在运行的内容 → /goal pause 暂停但不丢失上下文 → /goal resume 在暂停后继续 → /goal clear 结束当前目标 → /subgoal [文本] 在执行过程中添加条件
你设定一个目标。Hermes 将其分解为任务。它执行它们。它继续直到目标完成。你不用坐在那里看着。你走开。
默认的 max_turns 是 5 到 10。这对于严肃工作来说太低了。根据你要做的工作类型提高它。
→ hermes config set goals.max_turns 20 用于研究、报告和内容草稿 → hermes config set goals.max_turns 50 用于代码重构和多步骤构建
每次转动都会消耗 token,所以不要把它调到超出实际需要的程度。
让大多数开发者成为信徒的用例是隔夜运行。你在睡觉前给 Hermes 一个复杂任务。比如“研究 2026 年交付多代理设计的顶级设计工具中的前 5 名,总结它们的差异化因素,并起草一篇比较帖子。”你将 max_turns 设置为 30。你去睡觉。你醒来时看到一个等待审核的已完成草稿。
原本会占用你整个上午的工作,在你喝完第一杯咖啡之前就完成了。这一个小时的时间会复利。
第六步:打开仪表盘并使用看板
hermes dashboard
在浏览器中打开,地址是 localhost:9119。
第一次打开仪表盘时的一个明智操作:先点击“技能”,而不是“模型”。一个用得好的 Hermes 代理会累积超过一百个特定于你工作流的技能,全部存储为机器上可读的 markdown 文件。
这些是代理为自己编写的程序性记忆。每次它完成一个需要 5 次或更多工具调用的任务时,它都会编写一个技能文件,描述过程、已知陷阱和验证步骤。下次出现类似任务时,它会加载相关技能,而不是从头开始摸索一切。
浏览器自动化和电脑使用出于安全原因默认关闭。可以在仪表盘中为每个配置文件启用。
看板是大多数开发者日常使用的部分。守护进程(v0.16+)每 60 秒连续检查新任务。
工作流非常简单。将你的早晨待办事项列表放入“待分类”列。Hermes 读取每个项目,将其拆分为子任务,分配给子代理,并并行运行它们。到午餐时,大部分都已移动到“已完成”或正在等待你的特定批准。
这是 Hermes 不再感觉像你使用的工具,而开始感觉像你管理的团队的时刻。你进行协调。代理执行。瓶颈从“我提示的速度有多快”转变为“我规划得有多清晰”。
自我编写的技能:一个真实例子
再多一个值得展示的视觉效果,因为它让“自主技能创建”的声称变得具体。
Hermes 自行编写的每个技能都作为 markdown 文件存在于 ~/.hermes/skills/(或特定配置文件内的 skills 文件夹)中。它们是可读的、可版本化的。你可以提交它们。你可以分享它们。
这就是让“自我改进”的声明不仅仅是营销的原因。代理实际上将新过程写入了自己的工具包。你不需要手动设计这些。它们在你工作时积累。
一个此类技能文件的示例。五个部分:
→ 何时使用。代理监视的触发条件。 → 过程。代理下次将执行的编号步骤。 → 陷阱。已知的陷阱和边缘情况。(例如:“定价页面经常基于地理位置进行 A/B 测试。”) → 验证。代理在将任务标记为完成之前如何确认自己的工作。 → 自动改进说明。基于最近几次运行,过程中发生了什么变化。
何时使用 Hermes 对比 Claude Code
这是每个开发者首先会问的问题。最清晰的答案如下。
在以下情况下使用 Claude Code:
→ 你正在复杂的应用程序上深入进行专注的编码会话 → 你需要单个仓库内的持久上下文(CLAUDE .md 正在发挥作用) → 任务是一个你可以在一个会话中交付的、范围明确的单一功能 → 你需要绝对最好的编码模型,带有完整的规划模式和验证循环
在以下情况下使用 Hermes:
→ 任务是研究、文档、排程或业务分析 → 你需要一个自主运行数小时或隔夜的代理 → 你希望同一个代理可以通过 Telegram 从手机访问 → 你在构建一个应该跨周复利的长期工作流(内容、财务、研究) → 你需要多个具有独立内存的专门化代理并行运行
对大多数开发者来说诚实的答案是:两者都运行。
这就是我们在 IgnytLabs 正在推进的分工。Claude Code 留在编码循环中。Hermes 处理它周围的一切:运营、研究、草稿、审核、核对。两者不再争夺上下文。它们干净地分工。
这篇文章不是要你放弃当前的设置。而是告诉你,你错过了第二半。
相似文章
@PrajwalTomar_: 你没意识到这有多重大。今天你用的每个AI工具,一关闭标签页就会忘掉一切。MaxHerm…
MaxHermes 是一个跨会话保留记忆的AI代理,能从已完成任务中自动生成技能,并通过重复使用不断优化,实际上充当了消息平台工作流程中个性化、始终在线的助手。
@tavilyai:Hermes Agent 让我们得以一窥智能体的未来走向——它从每次会话中学习,自主编写技能,并持续构建记忆…
Nous Research 推出的 Hermes Agent 是一款开源自进化自主智能体,能够从每次会话中学习并随时间积累持久记忆。Tavily 作为其网络搜索后端接入,旨在提升搜索质量,防止错误数据在智能体的长期记忆与技能库中不断累积放大。
NousResearch/hermes-agent
Hermes Agent 是由 Nous Research 推出的开源、自我进化 AI 智能体框架,具备闭环学习循环、跨平台部署能力,并兼容数百种大语言模型。它提供终端界面、持久化记忆、自动化调度以及用于扩展 AI 工作流的科研级工具。
@akshay_pachaar: https://x.com/akshay_pachaar/status/2054564519280804028
Nous Research 推出的 Hermes Agent 综合指南,重点介绍其技能自进化、三层记忆架构以及用于构建持久化 AI 智能体的 GEPA 优化能力。
@ScottyBeamIO: https://x.com/ScottyBeamIO/status/2066885278451519590
Hermes Agent 是一个云端AI代理,持续运行并通过消息交互。它具有自我改进循环,从对话中提取模式以增强记忆和技能,并且拥有简化的设置和灵活的模型路由。