Hermes Agent 是由 Nous Research 开发的一款开源 AI Agent。与普通的 AI 聊天工具相比,它的核心目标并不是单纯“回答问题”,而是让 AI 能够真正进入用户的工作环境,调用终端、读写文件、使用浏览器、搜索互联网、运行代码、管理任务、调用 MCP、启动子智能体,并通过记忆和 Skills 在长期使用过程中积累经验。
Hermes Agent 的一个重要定位是 Self-Improving AI Agent(自我改进型 AI Agent)。官方将它描述为具有内置学习循环的 Agent:它可以根据使用过程创建或改进 Skills、保存跨会话记忆、搜索历史会话,并逐步形成更加完整的用户和工作习惯上下文。
目前 Hermes Agent 已经不仅是一个命令行 Agent,还包含完整的 TUI、Desktop、Messaging Gateway、Bot Mode、多智能体协作、定时任务、MCP、Skills、Memory、Browser Automation、Computer Use 等能力。
截至 2026 年 8 月 24 日,官方 GitHub 最新正式发布版本为 v0.20.4(2026.8.18)。v0.20.4 是针对 v0.20.3 的补丁版本,官方说明这一版本继续集中修复桌面端、Gateway、Bot Mode、Skills、Cron、SessionDB 等方面的问题。
一、Hermes Agent 是什么?¶
简单来说:
Hermes Agent 是一个可以运行在你的电脑、VPS、服务器或云环境中的开源 AI Agent。
传统 AI 聊天工具通常是:
用户 → AI → 文本回答
而 Hermes Agent 更接近:
用户
↓
Hermes Agent
↓
模型
↓
规划、推理
↓
调用工具
├─ 终端
├─ 文件
├─ 浏览器
├─ Web 搜索
├─ 代码执行
├─ MCP
├─ Memory
├─ Skills
├─ 子智能体
├─ Cron
└─ 其他外部服务
↓
完成任务
因此,它更适合那些需要“让 AI 动手做事情”的场景。
例如,你可以直接告诉 Hermes:
检查我的服务器磁盘空间,如果 /var 占用超过 80%,
找出占用最大的目录,并给我一个清理方案。
或者:
研究一下 OpenClaw、Hermes Agent 和其他开源 Agent,
整理成一篇适合 AI225 发布的文章,并保存为 Markdown。
又或者:
每天早上 8 点检查我的网站有没有异常,
如果发现问题,把结果发到飞书 / 钉钉。
这些任务已经明显超出了普通聊天机器人的范畴。
二、Hermes Agent 与普通 AI 聊天工具有什么区别?¶
Hermes Agent 最大的区别,并不是“模型更强”,而是 Agent 能力更完整。
它本身并不绑定某一个固定大模型,可以连接 Nous Portal、OpenRouter、OpenAI/Codex、Anthropic、Google Gemini、DeepSeek、Ollama、LM Studio 以及大量其他 Provider,也支持自定义 OpenAI 兼容 API。
也就是说:
Hermes Agent
↓
模型 Provider
├─ Nous Portal
├─ OpenRouter
├─ OpenAI
├─ Anthropic
├─ Gemini
├─ DeepSeek
├─ Ollama
├─ LM Studio
└─ 自定义 API
因此 Hermes 更像一个 AI Agent 运行平台,而不是单纯的一款模型客户端。
三、Hermes Agent 的核心特点¶
1. 自我改进与 Skills¶
Hermes 的一个特色是 Skills System。
Skills 可以理解成:
“告诉 Agent 某类工作应该怎么做的可复用操作手册。”
一个 Skill 通常由 SKILL.md 和相关脚本、参考资料等组成。
例如,可以有:
github-pr-workflow
arxiv
docker
kubernetes
pdf-processing
content-writing
research
当 Hermes 遇到相关任务时,可以加载对应 Skill,而不是每一次都从零开始理解整个工作流程。
官方采用的是 渐进式加载(Progressive Disclosure):
技能列表
↓
需要时加载 Skill
↓
需要参考资料时再加载具体文件
这样可以减少不必要的上下文消耗。Skills 还兼容 agentskills.io 开放标准。
更有意思的是,Hermes 自身还可以通过 skill_manage 创建、修改和删除 Skills。
也就是说:
完成复杂任务
↓
发现某个流程可以复用
↓
保存成 Skill
↓
以后自动复用
这也是 Hermes “自我改进”概念的重要组成部分。
2. 持久化 Memory¶
普通聊天中的上下文一般只存在于当前会话,而 Hermes 提供了跨会话的持久化 Memory。
官方内置 Memory 主要用于保存真正值得长期记住的信息,例如:
用户偏好
项目环境
工作习惯
长期目标
重要配置
历史经验
Hermes 同时提供 session_search,用于搜索以前完整的聊天记录。
两者定位不同:
| 功能 | 主要作用 |
|---|---|
| Persistent Memory | 保存长期重要事实 |
| Session Search | 查找以前具体讨论过的内容 |
官方文档指出,内置 Persistent Memory 是有界的、经过整理的长期记忆,而 Session Search 可以搜索整个历史会话数据库。
此外 Hermes 还支持多种外部 Memory Provider,例如 Honcho、Mem0、Hindsight、OpenViking、Supermemory 等,通过插件方式进一步扩展跨会话记忆能力。
3. 丰富的工具系统¶
Hermes 并不是只有几个固定工具。
官方文档目前列出的内置工具已经覆盖:
- Web Search
- Web Extract
- Browser
- Terminal
- File
- Code Execution
- Memory
- Session Search
- Image Generation
- Vision
- Text-to-Speech
- Todo
- Cron
- Delegate Task
- Computer Use
- MCP
- Home Assistant
- 以及多个消息平台专用工具
官方工具注册表目前约有 86 个工具,具体可用数量会根据平台、凭据和启用的 Toolset 而变化。
这些工具又被组织成不同的 Toolset。
例如开发场景可以使用:
coding
它可以组合文件、终端、搜索、Web、Skills、Browser、Todo、Memory、Delegation、Vision 等能力。
可以通过:
hermes tools
查看和管理工具。
四、Hermes Agent 可以做什么?¶
如果只把 Hermes 当成“终端聊天机器人”,实际上会低估它的能力。
1. AI 编程开发¶
Hermes 可以直接操作项目目录:
读取代码
→ 分析代码
→ 修改文件
→ 执行测试
→ 根据测试结果继续修改
→ 最后给出结果
它支持终端、文件编辑、代码执行、Git 工作流、Browser、Skills 和子智能体等,因此可以用于:
编写代码
调试 Bug
重构项目
运行测试
分析日志
修改配置
执行 Git 操作
部署项目
尤其适合 Linux/VPS 环境。
2. 服务器管理¶
Hermes 可以运行在 VPS 或服务器上。
例如:
检查 CPU、内存和磁盘
检查 Docker
查看 Nginx 日志
检查服务状态
分析错误日志
执行备份
检查端口
检查网站
对于已经习惯 SSH 的用户,Hermes 可以成为一个 AI 运维助手。
不过建议使用 Docker 等隔离后端处理高风险任务,而不是直接给 Agent 无限的宿主机权限。官方安全文档也明确建议在生产 Gateway 环境优先考虑 Docker、Modal、Daytona 或 Vercel Sandbox 等隔离后端。
3. 自动化研究¶
Hermes 支持 Web 搜索、网页提取、浏览器操作以及 Skills。
例如:
研究某个 AI 项目
↓
搜索官网
↓
阅读 GitHub
↓
分析文档
↓
比较多个项目
↓
整理结论
↓
生成 Markdown 报告
如果再结合子智能体,可以把研究任务拆成多个并行方向。
4. 自动生成内容¶
Hermes 也适合内容工作。
例如:
每天搜索最新 AI 新闻
↓
筛选有价值的内容
↓
阅读原始资料
↓
总结
↓
生成文章
↓
保存为 Markdown
再通过 Cron 和飞书 / 钉钉等中国用户可用的消息平台,就可以形成一个长期运行的内容 Agent。
五、Hermes Agent 安装教程¶
Hermes 当前已经支持多个平台。
官方安装方式目前包括:
- Windows 原生
- macOS
- Linux
- WSL2
- Android / Termux
同时 Hermes Desktop 提供 Windows 和 macOS 的桌面安装方式。
1. Linux / macOS / WSL2 安装¶
打开终端执行:
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
安装程序会自动处理 Hermes 所需的大部分运行环境,包括:
uv
Python 3.11
Node.js 22
ripgrep
ffmpeg
Linux 下需要提前保证 Git 可用,同时 Debian / Ubuntu 等系统建议安装:
sudo apt install git curl xz-utils
桌面端还可能需要:
sudo apt install build-essential
官方安装程序本身会尽量自动处理依赖,因此一般不需要用户手动安装 Python 或 Node.js。
2. Windows 原生安装¶
Hermes 目前已经支持 Windows 原生运行,并不要求必须使用 WSL2。
在 PowerShell 中执行:
iex (irm https://hermes-agent.nousresearch.com/install.ps1)
官方文档说明,原生 Windows 安装可以运行 CLI、Gateway、TUI 和工具;同时也可以与 WSL2 安装并存。
如果主要使用 Windows,我更建议先尝试原生安装;如果你的工作流大量依赖 Linux 工具,则可以考虑 WSL2。
3. Windows 使用 WSL2¶
安装 WSL2:
wsl --install
然后检查:
wsl --list --verbose
确认发行版的 VERSION 为:
2
Hermes 官方测试重点是 Ubuntu 等常见 Linux 环境,WSL1 并不可靠。
六、第一次启动 Hermes Agent¶
安装完成后,可以直接运行:
hermes
也可以:
hermes chat
执行一次性查询:
hermes chat -q "介绍一下 Hermes Agent"
查看版本:
hermes --version
查看状态:
hermes status
进行健康检查:
hermes doctor
这些都是官方 CLI 支持的常用命令。
七、配置 AI 模型¶
这是 Hermes Agent 使用过程中最重要的一步。
执行:
hermes model
Hermes 会进入交互式模型 / Provider 配置界面。
目前官方支持的 Provider 非常多,包括:
Nous Portal
OpenAI Codex
GitHub Copilot
Anthropic
OpenRouter
DeepSeek
Google Gemini
Qwen
MiniMax
xAI
NVIDIA
Hugging Face
Ollama
LM Studio
AWS Bedrock
Azure AI Foundry
OpenCode
以及各种自定义 Endpoint
具体列表会随着版本继续变化。
八、最简单的模型方案:Nous Portal¶
对于首次体验 Hermes 的用户,官方提供了:
hermes setup --portal
这个方式可以一次性配置 Nous Portal,并启用其 Tool Gateway。
官方文档说明,Nous Portal 可以通过一个订阅提供 300+ 模型,同时提供 Web Search、Image Generation、TTS、Browser 等 Tool Gateway 能力。
这样可以大幅减少:
申请多个 API Key
配置多个服务
单独配置 Web Search
单独配置图片生成
单独配置 TTS
对于初次使用的人,这是相对简单的入门方式。
九、使用 OpenRouter¶
如果已经在使用 OpenRouter,可以直接配置:
OPENROUTER_API_KEY
例如:
export OPENROUTER_API_KEY="你的API Key"
然后:
hermes model
选择 OpenRouter。
OpenRouter 的优势是可以在一个 Provider 中使用多个不同公司的模型,同时 Hermes 还支持 Provider Routing,可以进一步控制底层 Provider 的优先级、价格、质量以及数据策略。
例如:
provider_routing:
sort: "price"
only: []
ignore: []
order:
- "anthropic"
- "google"
具体配置应根据自己的 Provider 和模型情况调整。
十、使用本地 Ollama 模型¶
Hermes 也可以连接本地模型。
例如先启动 Ollama:
ollama serve
然后通过 Hermes:
hermes model
选择:
Custom endpoint
填写:
URL:
http://localhost:11434/v1
然后选择对应模型。
也可以在 config.yaml 中配置:
model:
default: qwen2.5-coder:32b
provider: custom
base_url: http://localhost:11434/v1
官方文档明确支持 Ollama、自托管模型、vLLM、LM Studio 和其他 OpenAI-compatible API。
因此,Hermes 并不要求一定使用云端模型。
十一、自定义 OpenAI 兼容 API¶
如果你使用的是其他 API 服务,也可以配置自定义 Endpoint。
例如:
model:
default: your-model
provider: custom
base_url: https://example.com/v1
然后根据服务要求设置 API Key。
这种方式尤其适合:
自建模型
内部 AI Gateway
企业模型服务
兼容 OpenAI API 的第三方平台
本地模型服务器
这也是 Hermes 保持 Provider 灵活性的一个重要原因。
十二、为什么 Hermes 要区分“模型”和“工具”?¶
这是理解 Hermes 的关键。
很多 AI Agent 的体验是:
模型本身很强
+
几个工具
Hermes 更强调:
模型
+
Tools
+
Toolsets
+
Skills
+
Memory
+
Delegation
+
Cron
+
Gateway
+
MCP
也就是说:
模型负责思考,Hermes 负责让模型能够做事。
例如:
用户:
帮我研究这个项目并写总结
模型:
分析任务
Hermes:
→ Web Search
→ Browser
→ File
→ Skills
→ Delegate
→ 保存文件
→ 返回结果
这就是典型的 Agent 工作方式。
十三、Skills 怎么使用?¶
查看 Skills:
hermes skills list
聊天中也可以:
/skills
搜索:
/skills search docker
或者:
/skills search research
安装官方可选 Skill:
hermes skills install official/research/arxiv
安装完成后即可调用。
Hermes 的官方文档特别强调:
Skill 更适合表达“流程、知识和操作方法”,Tool 更适合实现底层程序能力。
例如:
“如何完成一个 GitHub PR”
→ Skill
“执行浏览器点击”
→ Tool
十四、自己创建 Skill¶
这是 Hermes 非常值得尝试的一项功能。
例如建立:
~/.hermes/skills/my-writing/SKILL.md
最基本的结构类似:
---
name: my-writing
description: 我的文章写作流程
version: 1.0.0
---
# 写作流程
## When to Use
当用户需要撰写 AI 工具介绍时使用。
## Procedure
1. 查询官方网站
2. 查询 GitHub
3. 确认最新版本
4. 整理功能
5. 编写文章
6. 检查事实错误
7. 输出 Markdown
之后 Hermes 就可以把这套流程当成一个可重复使用的能力。
这也是为什么 Skills 可以看成 Hermes 的“程序性记忆”。官方明确将其定位为 procedural memory。
十五、Memory 怎么使用?¶
Hermes 的内置 Memory 可以理解成“长期记忆”。
例如你告诉 Hermes:
以后写 AI 工具介绍时,不要写营销腔,
尽量以官方资料为准。
如果这条信息被认为值得长期保存,它就可以进入持久化 Memory。
查看 Memory 相关状态:
hermes memory status
在聊天中也可以使用:
/memory
Hermes 还提供 Memory 写入审批机制。
例如开启:
memory:
write_approval: true
之后,对于自动产生的记忆,可以先进入待审核状态。
可以查看:
/memory pending
然后:
/memory approve <id>
或者拒绝:
/memory reject <id>
这样可以避免 Agent 因为一次错误理解,把错误信息永久写入长期记忆。
十六、子智能体 Delegation¶
Hermes 支持:
delegate_task
也就是让一个主 Agent 把工作拆给多个子 Agent。
例如:
主 Agent
├─ 子 Agent A:研究项目背景
├─ 子 Agent B:研究 GitHub
└─ 子 Agent C:整理竞争产品
最后由主 Agent 汇总结果。
官方文档说明,每个子 Agent 可以拥有独立的:
Conversation
Terminal
Toolset
上下文
子 Agent 默认看不到主 Agent 的历史对话,它只会获得主 Agent 在 goal 和 context 中明确传递的信息。
一个简单示例:
delegate_task(
goal="研究 Hermes Agent 的最新版本",
context="重点查看 GitHub Releases、官方文档和最新功能"
)
还可以并行:
任务 A:研究官方文档
任务 B:研究 GitHub
任务 C:研究社区应用
官方当前默认并发子智能体数量为 3,可以配置。
十七、Kanban:更适合长期多 Agent 协作¶
如果任务规模进一步扩大,可以使用 Hermes 的 Kanban。
它和普通 delegate_task 的区别在于:
delegate_task
→ 更适合当前会话中的短期并行工作
Kanban
→ 更适合持久化、多 Agent、长期任务协作
Kanban 使用本地数据库:
~/.hermes/kanban.db
每个任务都有状态、交接记录和评论,可以让不同 Agent 围绕任务板进行协作。官方把它定位为一个持久化的多 Agent 协作系统。
对于大型开发、内容生产、自动化运营等场景,这种方式比简单的“让模型开几个子任务”更加适合。
十八、Cron:让 Hermes 自动工作¶
Hermes 自带 Cron。
例如:
hermes cron
可以创建、编辑、暂停、恢复、运行和删除定时任务。
典型用途包括:
每天检查网站状态
每天整理 AI 新闻
每天检查服务器
定期备份
定时执行脚本
定时生成报告
定时发送消息
例如:
每天早上 8 点:
1. 搜索最近 24 小时 AI 新闻
2. 筛选重要消息
3. 整理成 Markdown
4. 把摘要发送到飞书 / 钉钉
这种场景正是 Hermes 和普通聊天工具区别最大的地方之一。
十九、Messaging Gateway:把 Hermes 变成真正的 Bot¶
Hermes Agent 可以连接非常多的消息平台。
目前官方文档列出的平台包括:
Telegram
Discord
Slack
WhatsApp
Signal
Email
Matrix
Mattermost
Feishu / Lark
WeCom
Weixin
QQ
Yuanbao
Microsoft Teams
LINE
Google Chat
Home Assistant
以及其他平台
官方目前已经支持 27+ 类消息平台 / 连接方式,并通过统一的 Gateway 管理。
对中国用户来说,很多海外平台(如 Telegram、Discord、WhatsApp 等)需要代理才能正常使用,体验并不好。 Hermes 原生支持的几个平台更适合国内日常使用:飞书(Feishu / Lark)、钉钉(DingTalk)、企业微信(WeCom)、个人微信(Weixin)、QQ、腾讯元宝(Yuanbao)。
这些平台在国内无需代理即可使用,其中多个还支持长连接(WebSocket / Stream Mode)方式接入,Hermes 运行时不需要公网 IP、不需要配置 Webhook,非常适合放在 VPS、服务器或本地电脑上。下面分别说明其接入方式与特点:
| 平台 | 接入方式 | 特点 |
|---|---|---|
| 飞书 / Lark | WebSocket 长连接(无需公网) | 功能完整,支持私聊、群聊、图片、文件、语音、消息反应、流式回复等,官方推荐 |
| 钉钉(DingTalk) | 官方 Stream Mode(WebSocket 长连接,无需公网) | 支持私聊、群聊、@提及、AI 卡片、表情反应,Markdown 回复 |
| 企业微信(WeCom) | AI Bot WebSocket(无需公网) | 扫描二维码即可创建机器人,支持私聊、群聊、媒体文件、回复关联 |
| 个人微信(Weixin) | iLink Bot 长轮询(无需公网) | 通过扫码登录个人微信机器人,可私聊;群聊依赖账号类型 |
| 官方 QQ Bot API(v2) | 支持私聊(C2C)、群聊 @、语音转文字,需要注册 QQ 官方机器人 | |
| 腾讯元宝(Yuanbao) | WebSocket 长连接 | 腾讯企业消息平台,支持私聊、群聊、图片、文件、语音,HMAC 认证 |
如果你希望快速体验国内可用的消息通道,比较推荐从 飞书 或 钉钉 入手:它们都支持长连接模式,不需要公网 IP,也不需要公网 URL,非常适合新手。下文也以这两个平台作为主要示例。
配置入口:
hermes gateway setup
启动:
hermes gateway
或者:
hermes gateway run
安装为系统服务:
hermes gateway install
启动服务:
hermes gateway start
查看状态:
hermes gateway status
官方文档也提供了 Linux systemd、macOS launchd 等服务管理方式。
二十、用飞书 / 钉钉 + Hermes 把远程服务变成长期助手¶
飞书 / 钉钉是国内用户最容易上手、也最“贴近日常”的两个消息平台:飞书功能最完整,钉钉则凭借 Stream Mode 长连接特别适合不想暴露公网端口的场景。两者都不要求公网 IP、不要求公网 Webhook 地址,Hermes 可以通过 WebSocket / Stream 直接连上平台官方服务器,因此尤其适合放在 VPS 上长期运行。
接入方式也很简单——在 VPS 上运行:
hermes gateway setup
在引导中选择「飞书 / Lark」或「钉钉 DingTalk」,然后按提示扫码或填入 App 凭据即可完成创建与授权。如果需要手动配置,官方文档也分别列出了 FEISHU_APP_ID / FEISHU_APP_SECRET(飞书)和 DINGTALK_CLIENT_ID / DINGTALK_CLIENT_SECRET(钉钉)等环境变量。更详细的接入设置可参考官方文档对应的「Feishu / Lark Setup」或「DingTalk Setup」章节。
如果你有一台 VPS,可以考虑:
VPS
↓
Hermes Agent
↓
飞书 / 钉钉 机器人
这样你不需要一直 SSH 登录服务器。
直接通过飞书 / 钉钉:
检查服务器
Hermes:
检查 CPU、内存、磁盘、Docker、网络……
然后把结果发回来。
甚至可以:
晚上 11 点执行备份
或者:
每天早上给我发送服务器状态
这就是一个真正长期运行的 AI Agent。
但需要特别注意:
不要因为飞书 / 钉钉很方便,就直接把对一个拥有宿主机全部权限的 Hermes Bot 暴露给任何人。
必须配置用户授权、DM 配对或 Allowlist。
二十一、Bot Mode¶
Hermes 还提供 Bot Mode。
它适合让多个专门的 Agent 形成一个长期运行的 Agent 团队。
例如:
项目经理
↓
开发 Agent
↓
测试 Agent
↓
研究 Agent
↓
内容 Agent
通过群聊、@mention 等方式让不同 Bot 协作。
这种方式比单纯的聊天机器人更加接近一个“小型 AI 团队”。Hermes 官方文档也将 Bot Mode 定位为可持续运行的 specialist Bots 团队。
二十二、浏览器自动化¶
Hermes 内置 Browser 工具集,可以:
打开网页
点击元素
获取页面内容
执行浏览器操作
处理页面交互
进行视觉分析
官方工具中包含 browser_navigate、browser_snapshot、browser_click、browser_back 等浏览器操作工具;如果连接 Chrome DevTools Protocol,还可以启用更底层的 CDP 能力。
这意味着 Hermes 不只能:
读网页
还可以:
操作网页
例如:
打开管理后台
→ 查看数据
→ 修改信息
→ 下载文件
不过涉及登录、支付、删除等敏感操作时,应该谨慎控制权限。
二十三、Computer Use¶
较新的 Hermes 版本还加入了 Computer Use 能力。
它可以在:
Windows
macOS
Linux
环境中进行桌面控制,并通过后台方式操作桌面应用。官方将其作为独立的 computer_use 工具集。
这让 Agent 的操作范围从:
终端
浏览器
进一步扩展到:
桌面应用
因此 Hermes 的自动化能力正在从“命令行 Agent”逐渐发展成更加完整的通用计算机 Agent。
二十四、MCP 支持¶
Hermes 支持 MCP(Model Context Protocol)。
因此可以连接外部 MCP Server,从而扩展自己的能力。
例如:
Hermes
↓
MCP
├─ GitHub
├─ 数据库
├─ 企业内部系统
├─ 文件服务
├─ API
└─ 其他工具
MCP 工具会动态加入 Hermes 的工具系统。
这意味着 Hermes 不需要把所有能力都内置进去,而可以通过标准化接口不断扩展。
二十五、Voice 语音能力¶
Hermes 当前还支持语音能力。
包括:
语音输入
语音转文字
语音回复
消息平台语音
飞书 / 钉钉语音频道
在本地还可以使用 faster-whisper 等方案处理语音识别。官方 Quickstart 提供了 Voice Mode 的额外安装方式,并可通过:
/voice on
开启。
如果使用 Nous Portal,还可以将 Web Search、Image Generation、TTS 和 Browser 等工具一起配置。
二十六、文件、项目上下文和 Checkpoint¶
Hermes 不只是“让 AI 看一个文件”。
它支持项目上下文文件,例如:
.hermes.md
AGENTS.md
CLAUDE.md
SOUL.md
.cursorrules
这些文件可以帮助 Hermes 理解项目中的:
代码规范
工作规则
项目背景
开发方式
行为约束
同时 Hermes 还支持 @ 引用,可以将文件、目录、Git Diff、URL 等内容直接加入上下文。
此外,Hermes 提供 Checkpoint 机制,可以在修改文件前对工作目录进行快照,以便在出现问题后使用:
/rollback
恢复。
二十七、安全机制非常重要¶
Hermes 是一个能够:
执行命令
修改文件
操作浏览器
访问网络
调用第三方 API
的 Agent。
因此安全性比普通聊天机器人重要得多。
官方当前采用纵深防御模型,包括:
- 用户授权
- 危险命令审批
- 文件写入安全
- 容器隔离
- MCP 凭据过滤
- Prompt Injection 检测
- 跨会话隔离
- 输入清理
二十八、危险命令审批¶
Hermes 默认不会对所有命令无条件放行。
例如一些高风险操作可能会要求人工批准。
审批模式目前包括:
approvals:
mode: smart
可选:
smart
manual
off
其中:
smart¶
默认模式。
由辅助模型评估风险:
低风险 → 自动执行
危险 → 拒绝
不确定 → 请求人工确认
manual¶
危险命令都要求用户确认。
off¶
关闭审批。
官方特别提醒:
approvals.mode: off会关闭全部安全审批,仅适合可信环境、CI/CD 或隔离容器等场景。
因此不建议为了“让 Hermes 不要总问我 Yes”就直接关闭全部安全机制。
更合理的方式是根据实际工作流建立 Allowlist。
二十九、Docker 隔离¶
如果希望 Hermes 更安全地执行命令,可以使用 Docker Backend。
例如:
terminal:
backend: docker
container_cpu: 1
container_memory: 5120
container_disk: 51200
container_persistent: true
Hermes 会在 Docker 容器中运行 Agent 的终端任务。
官方 Docker 安全配置包含:
Drop Linux capabilities
no-new-privileges
PID 限制
/tmp 限制
文件系统隔离
资源限制
并支持持久化或临时容器环境。
对于服务器上长期运行的 Hermes,我更推荐:
Hermes
↓
Docker / 隔离 Sandbox
↓
Agent 工作环境
而不是让 Agent 永久拥有宿主机的 root 权限。
三十、不要把“安全审批”和“沙箱”混为一谈¶
这是使用 Hermes 时非常重要的一点。
审批机制解决的是:
Agent 正常执行过程中,是否应该允许某个危险操作。
沙箱解决的是:
即使 Agent 或执行的代码出了问题,也尽量不要影响宿主机。
因此:
审批 ≠ 沙箱
官方也明确指出,危险命令检查并不是针对恶意进程的完整隔离机制;真正需要防御恶意或失控代码时,应使用 Docker、Modal 等隔离后端。
三十一、一个适合新手的 Hermes 使用方案¶
如果第一次接触 Hermes,不建议一上来就配置:
Gateway
Cron
MCP
多 Agent
Browser
Docker
Memory
几十个 Skills
这样很容易不知道问题究竟出在哪里。
官方 Quickstart 也建议:
先让一次普通聊天稳定运行,再逐步增加 Gateway、Cron、Skills、Voice、Routing 等功能。
推荐按照下面的顺序:
第一步
安装 Hermes
↓
第二步
配置一个模型
↓
第三步
完成一次普通聊天
↓
第四步
启用 Terminal / File
↓
第五步
安装 Skills
↓
第六步
启用 Memory
↓
第七步
尝试 Delegate
↓
第八步
配置 Cron
↓
第九步
配置飞书 / 钉钉
↓
第十步
根据实际需求增加 MCP、Browser、Docker 等
这样最容易排查问题。
三十二、一个实际的 VPS Agent 方案¶
如果手上有一台 Ubuntu VPS,可以搭建:
Ubuntu VPS
│
├─ Hermes Agent
│
├─ Docker
│
├─ Model Provider
│
├─ 飞书 / 钉钉 机器人
│
├─ Cron
│
├─ Skills
│
└─ Memory
然后形成这样的工作流:
飞书 / 钉钉
↓
Hermes Gateway
↓
模型
↓
Tools
├─ Terminal
├─ Browser
├─ Web
├─ File
├─ Docker
└─ MCP
↓
服务器 / 网站 / 项目
例如发送:
帮我检查服务器今天有没有异常。
如果发现异常,不要直接修改,
先告诉我原因和建议方案。
Hermes 就可以先完成信息收集,再返回结果。
这个模式非常适合:
服务器运维
网站维护
开发项目
自动化脚本
内容生产
信息监控
三十三、常见问题¶
1. Hermes 需要自己的 AI 模型吗?¶
不需要。
Hermes 是 Agent 框架 / 运行环境,可以连接各种模型 Provider。
例如:
OpenRouter
Nous Portal
OpenAI/Codex
Anthropic
Gemini
DeepSeek
Ollama
LM Studio
自定义 API
2. Hermes 可以使用本地模型吗?¶
可以。
支持:
Ollama
LM Studio
vLLM
OpenAI-compatible Endpoint
但要注意:
Agent 对模型的工具调用、推理、长上下文和指令遵循能力要求通常高于普通聊天。
所以“某个本地模型能够聊天”并不等于“非常适合运行 Agent”。
3. Hermes 必须在 Linux 上运行吗?¶
不是。
目前官方支持:
Windows
macOS
Linux
WSL2
Android / Termux
Windows 已经提供原生安装方式。
4. Hermes 和 Claude Code、Codex、OpenClaw 是什么关系?¶
它们不是完全相同的产品类别。
大致可以理解:
Claude Code / Codex
→ 更偏 AI 编程 Agent
Hermes Agent
→ 更偏通用 AI Agent + 自托管运行环境
OpenClaw
→ 更强调个人 AI Agent、消息渠道和自动化工作流
当然,这些项目的功能边界正在快速变化,实际使用中会有大量重叠。
Hermes 的突出特点主要是:
模型自由
+
Tool System
+
Skills
+
Memory
+
Delegation
+
Gateway
+
Cron
+
MCP
+
Security
+
Self-hosting
因此它更适合想自己搭建长期运行 AI Agent 的用户。
三十四、Hermes Agent 适合哪些人?¶
Hermes 特别适合:
开发者¶
用于:
编码
调试
测试
代码审查
Git
部署
VPS / 服务器用户¶
用于:
运维
日志分析
监控
Docker
自动化
内容创作者¶
用于:
资料搜索
研究
文章撰写
定时更新
内容整理
AI Agent 爱好者¶
可以用 Hermes 学习:
Tool Calling
Memory
Skills
MCP
Multi-Agent
Gateway
Agent Automation
想搭建个人 AI 助手的人¶
例如:
飞书 / 钉钉
+
Hermes
+
VPS
+
Memory
+
Cron
最后形成一个长期在线的个人 AI Agent。
三十五、Hermes Agent 的优点和不足¶
优点¶
1. 开源¶
可以自己部署、研究和修改。
2. 模型自由¶
不绑定单一模型,可以在多个 Provider 之间切换。
3. Agent 能力全面¶
从:
Terminal
File
Browser
Web
Memory
Skills
MCP
Cron
Delegation
到:
Messaging
Voice
Computer Use
覆盖范围很广。
4. 非常适合长期运行¶
尤其是:
VPS
Gateway
飞书 / 钉钉
Cron
Memory
组合起来以后,可以从一次性 Agent 变成长时间在线的个人 AI 助手。
5. 扩展能力强¶
Skills 和 MCP 让 Hermes 可以不断添加新的工作方式。
不足¶
1. 学习成本高¶
功能越多,配置项自然越复杂。
Hermes 不只是:
输入一句话
得到一句回答
而是一个完整 Agent 系统。
2. 对模型能力有一定要求¶
Tool Calling、长任务、代码修改、浏览器操作、多步推理,都要求模型具有较好的 Agent 能力。
3. 权限风险更高¶
因为 Hermes 真正可以:
执行命令
读文件
改文件
联网
操作网站
因此错误配置可能造成实际影响。
4. 项目发展很快¶
截至 2026 年 8 月,Hermes 的开发速度仍然非常快。
例如 v0.20.4 发布后,官方 GitHub 页面显示 main 分支已经继续积累了大量提交。对于追求稳定性的生产环境,更建议使用正式 Release,而不是直接跟随最新源码。
三十六、首次使用推荐配置¶
对于普通用户,可以从下面这套配置开始:
模型
└─ 一个稳定的云端模型或本地模型
工具
├─ terminal
├─ file
├─ web
└─ search
能力
├─ Skills
├─ Memory
└─ Cron
交互
└─ CLI
运行稳定后
├─ 飞书 / 钉钉
├─ Browser
├─ MCP
├─ Delegate
└─ Docker Sandbox
不要一次性全部开启。
三十七、推荐掌握的常用命令¶
日常使用最值得记住的是:
# 启动 Hermes
hermes
# 查看版本
hermes --version
# 选择模型
hermes model
# 查看状态
hermes status
# 健康检查
hermes doctor
# 查看工具
hermes tools
# 查看 Skills
hermes skills list
# 查看 Memory
hermes memory status
# 配置 Gateway
hermes gateway setup
# 启动 Gateway
hermes gateway run
# 查看 Gateway 状态
hermes gateway status
# 管理 Cron
hermes cron
# 更新 Hermes
hermes update
CLI 命令会随着版本继续增加,完整命令应以当前官方 CLI 文档和:
hermes --help
为准。
三十八、遇到问题先执行这几个命令¶
如果 Hermes 出现异常,建议首先:
hermes --version
然后:
hermes status
再:
hermes doctor
如果是 Gateway:
hermes gateway status
如果需要进一步排查,可以查看:
~/.hermes/logs/gateway.log
官方还提供了 hermes dump,可以生成经过脱敏的环境和配置摘要,方便提交 Issue 或向社区寻求帮助。
三十九、截至 2026 年 8 月,Hermes Agent 值得关注什么?¶
Hermes Agent 最近的重点已经不只是“CLI AI 编程助手”。
从 v0.18、v0.19 到 v0.20 系列,可以明显看到它逐步向一个完整 Agent 平台发展:
CLI
↓
Tools
↓
Skills
↓
Memory
↓
Subagents
↓
Kanban
↓
Gateway
↓
Bots
↓
Voice
↓
Computer Use
↓
MCP
例如 v0.18 引入了更加完整的 Mixture-of-Agents、任务完成验证、/goal、/learn 和 /journey 等能力;v0.20 又进一步加入 Voice、A2A、Webhooks、Grounded Citations 和 Desktop Artifacts 等方向。
这意味着 Hermes 正在从:
“一个可以调用工具的 AI CLI”
逐步发展成:
“一个可以长期运行、自我积累、连接多个平台和多个 Agent 的通用 AI Agent 平台。”
四十、总结¶
Hermes Agent 最值得关注的地方,并不是它单独拥有某一个特别强大的功能,而是它把很多 Agent 能力整合到了一个开源项目中:
模型
+
Tools
+
Skills
+
Memory
+
Browser
+
Terminal
+
MCP
+
Subagents
+
Kanban
+
Cron
+
Gateway
+
Bots
+
Voice
+
Computer Use
对于只想偶尔问 AI 几个问题的人,它可能显得过于复杂。
但对于希望把 AI 真正接入:
电脑
服务器
代码
项目
浏览器
飞书 / 钉钉
自动化任务
的人,Hermes Agent 是一个非常值得研究的开源项目。
尤其是拥有 VPS 的用户,可以把 Hermes 做成一个长期在线的个人 AI 助手:
VPS
↓
Hermes Agent
↓
模型
├─ Memory
├─ Skills
├─ Tools
├─ Cron
├─ Browser
└─ Subagents
↓
飞书 / 钉钉
最终实现的不再只是“让 AI 帮你回答问题”,而是让 AI 持续替你完成一部分真实工作。
官方资源¶
Hermes Agent 官网:
https://hermes-agent.nousresearch.com/
官方文档:
https://hermes-agent.nousresearch.com/docs
GitHub:
https://github.com/NousResearch/hermes-agent