@HermesWatcher: Hermes 又度过了一个疯狂的一周。上周规模巨大。不知何故,它没有放缓。在过去七天里,Hermes l…
摘要
Hermes 发布了一系列更新,包括浏览器自动化、多机器代理集群、对话中的实时交互式UI、独立代码审查、定时任务的持久记忆,以及改进的更新系统。
查看缓存全文
缓存时间: 2026/08/24 05:48
Hermes 又经历了不平凡的一周。
上周是巨大的突破。然而,这周的进展并未放缓。
在过去的七天里,Hermes 学会了控制你实际看到的浏览器;机器人模式蜕变为多设备代理集群;对话界面获得了实时交互 UI;Cron 任务拥有了持久化记忆;而 /review 功能为完成的工作提供了独立的第二双眼睛。
这些还只是主要亮点。
以下是 8 月 17-23 日期间 Hermes 的最重要更新:
▸ Hermes 现在可以操控你实际看到的浏览器:
应用内的预览浏览器不再是 Hermes 只能打开和查看的工具。
Hermes 可以检查页面、点击、输入、滚动、按键操作、导航、刷新,甚至可以为元素添加注释,让你精确看到它正在操作的目标。
这意味着 Hermes 可以在你已登录的可见浏览器会话中工作,而你则能实时观看整个过程。
这开启了极其丰富的工作流可能性。
▸ 机器人模式成为真正的多设备代理集群:
上周许多正在整合的功能,这周已成为真正的基础设施。
桌面端现在可以让你跨所有已注册的 Hermes 网关统一管理一个机器人模式名册,同时将每个机器人绑定到其实际运行的设备上。
本地。远程。SSH。Hermes Cloud。不同的机器。
远程机器人可以在不移动你常用工作区的情况下,打开真实的机器人聊天界面。
机器人现在还获得了 message_agent 功能,拥有了一种原生的代理间通信方式,无需再构建 shell 命令。
不同桌面端连接的机器人也可以互相通信。
群组房间也加入了真正的主题线程功能,支持图片、PDF、文件、粘贴和拖放附件。
机器人模式开始看起来不再像“多个配置文件”,而更像是一个真正的团队。
▸ 你的 Hermes 对话现在可以成为一个界面:
插件可以直接在对话中渲染实时 UI。
不是截图。
不是跳转到另一个应用的链接。
而是对话记录中真正的交互式 UI。
而且这不必是单向的。
与该 UI 的交互可以在后台向 Hermes 发送真实的回合指令,让代理执行更多工作,并实时更新你看到的内容。
聊天不再必须以文本结束。
▸ /review 为你的代理提供了独立的第二双眼睛:
你的主代理完成工作后。
运行 /review,Hermes 会启动一个独立的后台审阅者,拥有自己的工具集,用以检查对话背后实际完成的工作。
代码。PR。文档。研究。其他引用的工件。
审阅者可以遵循仓库自身的项目指令工作,并被告知主代理使用了哪些技能。
你还可以为 Review 功能指定单独的模型。
一个模型负责执行工作。
另一个模型独立进行检查。
审阅结果会返回原始会话,以便主代理做出回应、为工作辩护或修复疏漏。
这是一个重大更新。
▸ Cron 远不止“在早上 8 点运行此提示”那么简单:
Cron 代理现在可以使用 Hermes 的持久化记忆,包括 MEMORY.md 和 USER.md。
单个任务也可以固定其自身的推理强度,这样轻量的定期检查就不需要与计划深度分析相同的推理预算。
而计划输出现在可以直接作为真实的新回合,投递到机器人的标准机器人聊天界面中。
机器人读取并响应。
现在开始结合调度、记忆、机器人模式和无人值守工作吧。
这很快会变得非常有趣。
▸ hermes update 现在会检查更新是否确实成功:
这个功能不那么炫酷,但很重要。
Hermes 正在围绕一个现实重建更新程序:一次安装可能同时运行多个配置文件、网关、服务和运行时。
hermes update --plan 可以在不触碰任何东西的情况下,先盘点整个集群。
更新会生成结构化的收据。
运行中的网关可以报告它们实际提供的代码版本。
重启阶段现在必须考虑到计划中的运行时。
如果 Hermes 预期更新某个部分但它被遗漏、过时或已停止,更新程序会明确失败,而不是静悄悄地宣告成功。
这是一种真正让人在第一次出问题时会感激的枯燥基础设施改进。
▸ 长时间运行的任务获得了重要的可靠性提升:
旧的默认 500 轮次上限已被移除。
Hermes 现在默认无限轮次运行,除非你选择设置上限。
新的停滞检测机制还能识别出代理反复进行相同工具调用,或宣布即将继续执行却又停止的情况。
如果 Hermes 重新运行同一工具并得到完全相同的大结果,它仍然会全新执行该工具,但可以向模型提供一个指向先前结果的小引用,而不是再向上下文中倾倒 2-5 万个字符。
MCP 结果也获得了更紧凑的上下文处理。
目标相当简单:
让长时间运行的任务持续工作,防止代理在沉默中空转或陷入重复的上下文中。
▸ 全新安装的 Hermes 在开始有用工作前需要更少的 API 密钥:
Hermes 现在提供了跨多个支持供应商的、无需密钥的 Web 工具路径。
还有一个新的 opencode-free 提供商,用于 OpenCode 的免费层级,无需 API 密钥或 OpenCode 帐户。
它也会出现在常规的模型选择器中。
安装 Hermes。
选择一个可用的免费模型。
交给它一个任务。
“我刚安装 Hermes”和“我的代理正在做有用工作”之间的距离正在不断缩短。
▸ 仓库现在可以自带 Hermes 技能:
仓库可以在 .hermes/skills/ 或 .agents/skills/ 下包含特定项目的技能。
在该项目范围内,这些技能可以优先于较低版本的相同技能。
Hermes 为此设置了信任边界。
仓库必须受信任,项目技能在加载时会被扫描,未知仓库不会静默获得权限来注入其自己的代理指令。
对于围绕代码库构建可重复 Hermes 工作流的团队来说,这可能变得极其有用。
其他须知事项:
→ 桌面端语音功能可以直接通过当前配置文件使用受支持的 STT/TTS 提供商。
→ 符合条件的 Codex GPT 会话现在默认使用 272K 上下文窗口,当你确实需要更大窗口时,有明确的 -900k 变体选项。
→ /model 命令获得了模糊搜索功能。
→ 桌面端新增了命令面板。
→ /status 命令提供了更有用的会话信息。
→ clarify 命令现在可以一次性提出多个独立问题,而不是一次打断你一个问题。
→ Hermes 可以自行应用桌面端布局预设。
→ 插件现在可以从 Git 或 hermes:// 链接安装,并在安装前有一个审查步骤。
上周的故事是 Hermes 学会了持续工作、分派任务、监督代理并在机器间协调。
这周是当这些组件开始连接时所发生的事情。
代理可以使用你看到的浏览器。
机器人可以跨设备工作和通信。
计划任务可以记忆、唤醒机器人并将工作交还给团队。
代理可以在对话中构建界面。
而当工作完成后,另一个代理可以独立地检查它。
Hermes 正开始看起来不像一个功能繁多的强大单一代理,而更像是一个操作层,支持一个能真正协同工作的代理团队。
相似文章
@0xJeff: https://x.com/0xJeff/status/2066883577141428563
Hermes Analyst 获得重大更新,包括重新设计的用户界面/用户体验、更简单的代理配置、用于改进研究的嵌套编排器、Hermes Desktop 和 Windows 版本发布,以及与 Stripe 的集成。
@intheworldofai: Hermes Agent 正在快速发展。就在过去一周内,Nous Research 增加了:- 完整的 WebUI/桌面应用 - 后台计算…
Nous Research 发布了开源 Hermes Agent 的重要更新,新增了原生 macOS 后台电脑使用功能、通过看板进行多智能体编排,以及 Lightpanda 浏览器集成。
@GitTrend0x: Hermes 进化,生态又火爆了 42-evey/hermes-plugins(https://github.com/42-evey/hermes-plugins…) 目标管理 + 多 Agent 桥接 + 智能模型路由 + 成本控制 +…
Tweet highlighting multiple new Hermes agent plugins that add autonomous operation, skill creation, multi-agent orchestration, Nextcloud integration, and long-horizon task planning, turning Hermes into a 24/7 autonomous teammate.
@kjut4q:我这周部署了Hermes。很多人说想试试,我正在逐周记录整个过程,包括它学到了什么,为自己构建了什么……
作者部署了 Hermes AI 代理,并计划逐周记录其进展,分享它在实际使用一个月内学到和构建的内容。
@GitTrend0x: Hermes 继续自进化,宝藏接一连三出现! Kali 渗透测试技能,Dashboard 深色主题包、像素世界桥接、AIOps 运维军团、原生视频创作管线……全网程序员把 Hermes 玩成了下一代 Agent 红队黑客 + 丝滑仪表盘 …
Hermes Agent 生态迎来多项社区更新,包括 Kali 渗透测试技能、深色主题仪表盘、像素元宇宙桥接、AIOps 运维及视频创作管线,展示了 AI Agent 在安全测试与自动化运维方面的新能力。