@FareaNFts: https://x.com/FareaNFts/status/2091538403611533820
摘要
这是一份指南,介绍设置强大Hermes AI代理所需的17项必备技能,涵盖互联网访问、UI改进、多代理编排等工具,以增强功能性。
查看缓存全文
缓存时间: 2026/08/24 03:47
在全新Hermes配置中我会安装的17项技能(10倍效能秘籍)
如果明天重置Hermes从零开始,我不会打开空白对话框“摸索着来“。
我会先安装技能。
原生Hermes已足够智能,但装备技能的Hermes才是真正的降维打击。技能是普通聊天机器人与高级智能体之间的分水岭——后者能自主研究、编程、剪辑视频、优化文本、执行循环任务,同时处理多项工作而无需你时刻盯着终端界面。
以下是我实际会加载的完整技能清单。并非涵盖互联网上所有技能,而是精选了17项足以应对绝大多数真实工作场景的实用技能。
每项技能的功能解析、安装时机及新手避坑指南。
#技能 功能 关注量(约)
1Agent-Reach为智能体配备无需付费API的互联网感知能力~73k
2make-interfaces-feel-better修复影响应用质感的UI细节问题~3k
3oh-my-hermes面向Hermes的多智能体规划与验证执行框架~270
4Anthropic Cybersecurity Skills海量智能体安全技能库~30k
5OpenMontage将编程智能体转变为视频制作团队~49k
6Minions面向Hermes任务的看板式控制中心~625
7Resemble Detect检测AI生成的音频/图像/视频~小众领域
8addyosmani/agent-skills从规范→计划→构建→测试→发布的工程技能链~89k
9Composio skills实现智能体与真实应用的连接(认证、工具、触发器)Composio生态系统
10youtube-full无需与yt-dlp对抗即可获取YouTube字幕、搜索、频道内容~540
11Humanizer消除AI写作痕迹的文本润色技能~热门技能
12Defuddle将网页内容清洗为可读Markdown格式~9k
13Matt Pocock skills轻量级可组合的工程实践技能~224k
14SkillClaw通过实际工作自我优化的技能系统~2.5k
15Browser Harness智能体操控真实浏览器并学习辅助工具~17k
16codebase-memory-mcp将代码库索引为智能体可查询的知识图谱~40k
17Loopy / Loop Library具备检查与终止规则的可重复智能体循环~3k
什么是“技能”?
将技能理解为智能体可随时调取的配方卡片。
无技能时:
- 每次会话需重复解释相同流程
- 输出质量受模型状态影响
- 多步骤工作易偏离轨道
有技能时:
- 步骤标准化且可复用
- 智能体自动匹配任务加载对应方案
- 相同配方可跨项目共享
Hermes已内置基础技能,但这17项外部扩展包是构建专业级配置的关键模块。
1. Agent-Reach
仓库:Panniantong/Agent-Reach
关注量:~73k
功能定位
命令行工具,为智能体提供公共互联网感知能力——覆盖X/Twitter、Reddit、YouTube、GitHub等平台,无需为每个服务配置付费API。
解决痛点
智能体能编写代码,但遇到“查看推特反应“或“总结YouTube教程“类请求时,常因爬虫限制、付费墙、登录验证、杂乱HTML而失败。
新手适用场景
安装后可直接使用:
- 搜索X平台对该工具的讨论
- 获取YouTube字幕并总结
- 在Reddit查找同类问题
最佳使用时机
内容调研、竞品分析、社交媒体监测、技术支持研究。
2. make-interfaces-feel-better
仓库:jakubkrehel/make-interfaces-feel-better
关注量:~3k
功能定位
专注UI质感提升的智能体技能:涵盖动画效果、字体排版、图标设计、悬停状态、点击区域、阴影效果、视觉对齐等让界面显得专业的细节。
解决痛点
AI构建的UI常出现“能用但别扭“的问题:间距错误、悬停效果缺失、按钮尺寸不当、文字排列机械。
新手使用建议
智能体构建页面后,加载此技能并要求其专注于界面“质感“而非“功能“的优化。
适用场景
落地页、仪表盘、内部工具及任何新交付的前端项目。
安装指令
npx skills add jakubkrehel/make-interfaces-feel-better
3. oh-my-hermes (OMH)
仓库:witt3rd/oh-my-hermes
关注量:~270
功能定位
受oh-my-claudecode启发的多智能体协作技能包,包含深度调研、需求访谈、共识规划及验证执行等模块。
核心技能
| 技能 | 功能 |
|---|---|
| omh-deep-research | 分解研究→并行搜索→综合分析→引用验证 |
| omh-deep-interview | 苏格拉底式需求访谈 |
| omh-ralplan | 规划师/架构师/评审员循环辩论直至方案成型 |
| omh-ralph | 实施→验证→循环直至完成 |
| omh-autopilot | 上述流程的完整自动化管线 |
解决痛点
单一智能体处理大型任务时常忽略需求分析、规划薄弱,最终“完成“却缺乏验证依据。
最佳使用场景
陌生领域探索、多日开发特性、任何需要先保证规划质量再编码的场景。
推荐工作流
调研→访谈→ralplan→ralph
4. Anthropic Cybersecurity Skills
仓库:mukul975/Anthropic-Cybersecurity-Skills
关注量:~30k
功能定位
海量结构化网络安全技能库(约817项技能,覆盖多安全领域),已映射至MITRE ATT&CK、NIST CSF、ATLAS等框架。
重要说明
这是社区项目,非Anthropic官方产品。包含的渗透/双重用途技术仅限授权测试、防御、研究与教育用途。
解决痛点
默认编程智能体不具备高级安全分析师能力。这些技能为其提供调查、检测、取证式工作流及框架对齐的指导方案。
适用场景
安全评审、事件响应草案、威胁建模、授权红队演练、通过智能体导师学习安全工作流。
新手守则
仅对自有系统或获得书面授权测试的系统使用。
5. OpenMontage
仓库:calesthio/OpenMontage
关注量:~49k
功能定位
开源智能体视频制作系统。提供管线、工具及制作知识文件,将编程智能体转化为小型视频制作团队。
解决痛点
视频制作涉及脚本、素材、剪辑、字幕、导出等复杂工具链。多数智能体仅能“讨论视频“,而OpenMontage面向实际制作工作流。
适用场景
短视频内容、解说视频、产品演示、需要智能体协作的YouTube风格制作。
目标用户
已日常使用智能体并希望产出媒体内容(不仅是文本)的创作者与营销人员。
6. Mission Control / Minions
仓库:agent37-platform/minions
关注量:~625
功能定位
面向Hermes任务的看板式控制面板。可创建任务、监控执行、审核结果,避免长时间作业在终端历史中消失。
解决痛点
Hermes能力强大,但在原始终端管理多个并行会话却很困难。容易遗忘完成状态、卡住进度及待审核事项。
核心功能
- 看板状态:进行中/审核中/已完成
- 工具调用实时流
- 完成前人工确认环节
- 任务级模型配置
- 定时Hermes任务
- 本地优先选项(SQLite存储)
快速启动
npx minionsai
然后访问 http://localhost:6969。
适用场景
任何将Hermes作为实际工作伙伴(非一次性聊天工具)的用户。
7. Resemble AI Detect
仓库:resemble-ai/detect-skill
功能定位
基于Resemble检测技术的媒体安全技能,用于识别AI生成或篡改的音频、图像、视频。
解决痛点
深度伪造与合成媒体泛滥。当智能体处理用户生成内容、品牌安全或研究任务时,需要在信任媒体前进行验证。
最佳使用场景
内容审核流程、品牌安全检查、引用或转发前的“该片段是否真实“验证。
诚实提醒
检测评分仅供参考,非法庭证据。高风险决策务必保留人工判断环节。
8. addyosmani/agent-skills
仓库:addyosmani/agent-skills
关注量:~89k
功能定位
源自Addy Osmani实践的生产级工程技能:覆盖定义→规划→构建→验证→评审→发布的全生命周期。
命令思维模型
| 命令 | 含义 |
|---|---|
| /spec | 定义构建目标 |
| /plan | 分解为小任务 |
| /build | 分片实现 |
| /test | 验证有效性 |
| /review | 提升代码质量 |
| /webperf | 优化前测量 |
| /ship | 安全发布 |
解决痛点
“氛围编程“缺乏质量门禁。这些技能强制践行资深工程师的标准:规范文档、任务拆分、测试覆盖、代码评审。
最佳使用场景
真实产品(非一次性脚本),尤其适合前端/Web开发及多日开发特性。
安装指令
npx skills add addyosmani/agent-skills
9. Composio skills
仓库:ComposioHQ/skills
功能定位
可分发的技能包,指导智能体如何与Composio集成平台协作:包括工具路由、认证、会话管理、触发器及生产环境模式。
解决痛点
将智能体连接至Gmail、Slack、GitHub、CRM等应用通常流程混乱。Composio作为集成层,这些技能教会智能体安全模式(用户标识、会话、Webhook、框架集成)。
适用场景
任何需要真实应用操作(不仅是本地文件)的Hermes/智能体配置。
安装指令
npx skills add composiohq/skills
10. youtube-full (YouTube技能包)
仓库:ZeroPointRepo/youtube-skills
关注量:~540
功能定位
为智能体提供:
- 获取YouTube字幕
- 搜索视频内容
- 浏览频道信息
- 提取播放列表
无需对抗云端IP的yt-dlp封锁。
解决痛点
“总结YouTube视频“是智能体最常见失败场景之一。本技能包专为此任务设计。
Hermes安装指令
hermes skills install ZeroPointRepo/youtube-skills/skills/youtube-full
适用场景
教程学习、内容调研、竞品视频分析、课程笔记整理。
免费额度提示
底层字幕API注册即送免费额度,具体限制请查阅官网说明。
11. Humanizer
仓库:blader/humanizer
功能定位
将AI风格文本重写为自然人类写作,基于维基百科“AI写作特征“模式识别。
解决痛点
智能体草稿虽实用但常带“公关稿腔调“:充斥“关键“、“格局”、“不是X而是Y“等短语,完美三段式列表,空洞的夸大表述。
实际工作流
- 初步重写(不刻意保护AI结构)
- 检查残留AI痕迹
- 二次润色
- 保持事实准确,不虚构名称/数字
适用场景
智能体撰写的每篇公开文章、文档页面、客户邮件或发布公告。
专业技巧
粘贴你自己的2-3段文字,要求匹配你的写作风格。
12. Defuddle
仓库:kepano/defuddle
关注量:~9k
功能定位
将杂乱网页转化为干净HTML或Markdown的库/命令行工具。由Obsidian Web Clipper团队(kepano)开发。
解决痛点
智能体抓取网页时,常被导航栏、广告、Cookie横幅和嵌套HTML干扰。Defuddle能有效过滤杂质。
适用场景
研究调研、网页剪藏、为Hermes提供干净上下文、构建自定义阅读管道。
简易思维模型
输入URL或HTML → 输出可读文章。
13. Matt Pocock skills
仓库:mattpocock/skills
关注量:~224k
功能定位
Matt的日常工程技能:轻量、可组合、可修改。面向真实应用场景,非“氛围编程表演“。
核心理念
大型流程框架会剥夺你的控制权。这些技能保持小巧以便自由定制。
解决痛点
智能体要么无流程规范,要么配备无法调试的巨型流程框架。Matt的技能库恰到好处。
适用场景
TypeScript/应用工程、工单分类、项目规划及日常智能体协作开发。
安装指令
npx skills@latest add mattpocock/skills
然后为每个仓库运行一次设置技能。
14. SkillClaw
仓库:AMAP-ML/SkillClaw
关注量:~2.5k
功能定位
技能从真实使用中进化的系统。日常对话时,它在后台消化会话记录、优化技能、去重垃圾内容,并跨智能体/设备积累经验。
解决痛点
Hermes技能文件夹易沦为“杂物抽屉“:重复项、半成品笔记、过时步骤。缺乏系统性消化学习过程。
适用场景
若你日常依赖Hermes,希望技能库随时间自动优化,避免每周手动整理。
诚实定位
这是面向高级用户的基础设施。建议在掌握基础技能集后再尝试。
15. Browser Harness (荣誉提名)
仓库:browser-use/browser-harness
关注量:~17k
功能定位
自愈式浏览器控制框架。LLM通过CDP连接真实浏览器执行任务,并在遇到不支持步骤时自动生成辅助工具。
解决痛点
传统静态浏览器工具在网站改版后立即失效。此方案在工作过程中持续优化控制框架。
任务示例
“打开我的X账号,抓取最新20条视频帖子并下载。”
适用场景
需登录的浏览器操作、重复性网页事务、依赖真实会话Cookie的任务。
风险提示
授予智能体真实浏览器权限既强大又危险。建议从独立配置文件开始实验。
16. codebase-memory-mcp
仓库:DeusData/codebase-memory-mcp
关注量:~40k
功能定位
高性能MCP服务器,将代码库索引为持久化知识图谱。智能体通过图谱查询结构,避免每次会话重新阅读40个文件。
核心价值
逐文件探索既消耗token又易遗漏架构信息。图谱查询可快速回答:
- 该组件在何处使用?
- 函数调用关系如何?
- 修改此处会影响哪些部分?
特性宣称
- 支持158种编程语言
- 极速索引能力
- 相比朴素探索大幅节省token
- 本地处理(代码不离开你的设备)
适用场景
中大型代码库、多服务架构、任何因上下文切换而效率低下的Hermes编程任务。
17. Loop Library / Loopy (荣誉提名)
仓库:Forward-Future/loopy
关注量:~3k
功能定位
包含两部分:
- 公开智能体循环目录
- Loopy技能:用于发现、审计、适配、设计及运行这些循环
什么是“循环“?
单次提示说:执行一次任务。
循环说:执行一步→评估效果→仅保留有效结果→重复直至达到终止条件。
示例
找到最慢页面→优化单个指标→重新测量→仅保留有效优化→当目标达成或收益停滞时停止
适用场景
性能优化、不稳定测试、文档清理、周期性运维——任何首次尝试非最终结果的场景。
核心思想
循环之所以强大,在于其有限性:明确检查点、明确终止条件、需要判断时切换人工处理。
17项技能的协同组合(简易配置方案)
基础Hermes配置
- Agent-Reach - 互联网接入能力
- youtube-full - 视频内容学习
- Defuddle - 网页内容清洗
- Humanizer - 公开文本优化
- Minions - 任务看板可视化
专业编程配置
- codebase-memory-mcp - 避免重复代码阅读
- addyosmani/agent-skills 或 Matt Pocock skills - 工程流程规范
- oh-my-hermes - 多智能体规划/验证
- make-interfaces-feel-better - 最终UI质感优化
内容/媒体配置
- OpenMontage - 视频制作
- youtube-full - 素材获取
- Humanizer - 字幕与文案优化
- Resemble Detect - 媒体真实性验证
高级用户成长配置
- SkillClaw - 技能从使用中进化
- Loopy - 将重复工作转化为循环任务
- Browser Harness - 真实浏览器事务处理
- Composio skills - 应用系统集成
新手安装顺序建议
切勿首日安装全部17项技能。
首日安装
- Agent-Reach
- Humanizer
- youtube-full
次日安装
- Minions(若需运行多个Hermes任务)
- Defuddle
- 任一工程技能包(Matt或Addy)
第三日及以后
- codebase-memory-mcp:针对真实代码库
- oh-my-hermes:任务复杂度提升时启用
- OpenMontage / Browser Harness:仅在有相应需求时安装
技能数量≠效能提升。真正高频使用的小型技能库,远胜于杂乱无章的技能抽屉。
安全与基本准则
部分技能涉及真实浏览器、代码库或安全攻防技术。
简单守则:
- 仅在授权环境中使用攻击性安全技能
相似文章
@akshay_pachaar: https://x.com/akshay_pachaar/status/2054564519280804028
Nous Research 推出的 Hermes Agent 综合指南,重点介绍其技能自进化、三层记忆架构以及用于构建持久化 AI 智能体的 GEPA 优化能力。
@nyk_builderz: https://x.com/nyk_builderz/status/2074000009646014658
一份关于如何将Hermes Agent设置为自我改进的操作系统用于代理工作流的大师级指南,涵盖技能、工具、记忆和自动化循环,将代理转化为复合生产力系统。
@zaimiri: https://x.com/zaimiri/status/2066117404392890835
一份详细的7天指南,教你搭建Hermes AI代理,涵盖身份、记忆、工具和Telegram集成。
@itsolelehmann: https://x.com/itsolelehmann/status/2056343273023688989
一份关于通过集成12种工具(如Firecrawl、Reddit和Stripe)将Hermes转变为超级代理的指南,涵盖研究、行动、工作空间和记忆功能。
@KanikaBK: https://x.com/KanikaBK/status/2053845110048293272
本文提供了一份逐步指南,用于安装和配置 Hermes Agent。Hermes Agent 是由 Nous Research 开发的一款开源、具备自我改进能力的 AI 智能体。内容涵盖系统要求、通过终端安装、连接 Telegram 等消息网关,以及与各大大型语言模型(LLM)服务商的集成。