- 太长不看
- Hermes Agent 是什么?(以及它不是什么)
- 配置:将 Hermes Agent 连接到 OpenRouter
- 选择模型
- 提供商路由、备用方案与辅助模型
- 监控用量与故障排查
- 常见问题解答
Hermes Agent 是 OpenRouter 上按 token 用量计算使用最多的应用,迄今已处理超过 17 万亿个模型 token。OpenRouter 是人们运行 Hermes Agent 的主要方式之一,因此其配置方案成熟、应用广泛且得到全面支持。
Hermes Agent 是 Nous Research 开发的一款开源自主智能体,直接在终端中运行,并且可以与您选择的任何模型配合使用。当您将其连接到 OpenRouter 时,即可通过一个 API 密钥访问来自 60 多家提供商的 400 多个模型,同时享受自动故障转移和统一账单服务。
首先需要澄清一点:Hermes Agent 和 Hermes 模型家族(Hermes 3 和 Hermes 4)是 Nous Research 同一生态系统中的不同部分。Hermes Agent 是应用程序,而 Hermes 3 和 Hermes 4 是它可以运行的语言模型。本指南将解释这一区别,然后逐步介绍完整的配置和路由设置。
太长不看
- Hermes Agent 是 Nous Research 开发的开源自主 CLI 智能体。Hermes 3 和 Hermes 4 模型是独立的;该智能体可以在两者中的任何一个上运行,也可以通过网关在任何模型上运行。
- 基本设置的默认模型是 ~anthropic/claude-sonnet-latest。openrouter/auto 和 openrouter/pareto-code 是针对特定用例的可选路由模式。
- 大多数配置需要一个至少具有 64K 上下文窗口 token 的模型。较小的窗口可能会被拒绝,因为系统提示词加上工具模式会填满它们。在选择之前,请查看 openrouter.ai/models 上的上下文长度。
- 一个 OpenRouter 密钥即可让智能体访问来自 60 多家提供商的 400 多个模型,并对受支持的模型启用自动故障转移,因此单一提供商的中断不会中断会话。
- 路由配置、备用链和辅助模型卸载功能位于 ~/.hermes/config.yaml 中。标题生成和视觉处理等辅助任务可以在比主循环更便宜的模型上运行。
- 运行该智能体是免费的(采用 MIT 许可证);您只需为其消耗的模型 token 付费。有关当前计费详情,请参阅 openrouter.ai/pricing。
Hermes Agent 是什么?(以及它不是什么)
围绕 Hermes 的许多混淆源于 Nous Research 同时创建了一个智能体和一个同名的语言模型家族。Hermes Agent 是一个命令行应用程序,而 Hermes 3 和 Hermes 4 是可以作为该智能体后端使用的语言模型。
当人们搜索“Hermes 3”、“Hermes 4”或“Hermes 4 405B”时,他们通常是在寻找语言模型。Hermes Agent 是应用程序,而 Hermes 3 和 Hermes 4 是可以用作其后端的模型。
智能体 vs 模型:概念澄清
| Hermes Agent | Hermes 3 / Hermes 4 | |
|---|---|---|
| 它是什么 | 自主 CLI 智能体(一个应用程序) | 语言模型(大脑) |
| 开发者 | Nous Research | Nous Research |
| 运行方式 | 安装 CLI,将其指向一个模型 | 通过服务商将其作为模型 ID 调用 |
| 许可证 | 开源(MIT) | Nous Research 模型权重,遵循其自身条款 |
| 关系 | 需要一个模型来进行思考 | 可以作为 Hermes Agent 运行的模型后端 |
Hermes Agent 实际能做什么
Hermes Agent 内置了 40 多种工具,用于网页搜索、浏览器自动化和图像理解等任务。它还包含一个消息网关,可连接到超过 20 个平台,包括 Telegram、Discord、Slack、WhatsApp、Signal 和 Matrix。
它与典型聊天界面的区别在于其持久记忆系统。它可以跨会话记住信息,因此您无需在每次开始新对话时都重复项目细节或上下文。
该智能体在运行环境方面也很灵活。您可以将其部署在本地机器上,或使用 Docker、SSH、Daytona、Modal 和 Singularity 等环境。
为什么通过 OpenRouter 运行 Hermes Agent?
如果您曾与多个 AI 服务商合作过,就会知道事情会变得多么混乱。每个服务商都有自己的账户、API 密钥、计费设置和模型目录。OpenRouter 让您只需一个 API 密钥和一个计费账户,就能访问来自 60 多个服务商的 400 多个模型。
OpenRouter 已经是 Hermes Agent 最流行的后端。截至 2026 年 6 月,Hermes Agent 在 OpenRouter 的应用排行榜上按总 token 使用量排名第一,处理了超过 17 万亿个 token。该集成被广泛使用、充分测试,并已在规模化场景中得到验证。
| 无网关 | 使用 OpenRouter |
|---|---|
| 每个供应商一个账户、一个密钥、一张账单 | 一个密钥即可访问 60 多个供应商的 400 多个模型 |
| 当供应商返回 5xx 错误或触发速率限制时,需手动重试 | 自动故障转移,会话中无需人工干预 |
| 部分供应商对失败的调用仍会收费 | 失败的请求不收费 |
| 每个供应商仪表盘有独立的使用量视图 | 一个活动仪表盘涵盖所有模型 |
| 供应商标价加上您自己的加价计算 | 无加价;目录价格加上平台费用 |
您只需更改一个字符串即可在模型之间切换。智能体所做的所有操作都会通过您在 openrouter.ai/activity 的使用量视图在一个地方被追踪。
OpenRouter 会自动在供应商之间进行负载均衡,并在某个供应商返回 5xx 错误或达到速率限制时自动切换,从而确保长时间运行的智能体任务不会因供应商宕机而中断。失败请求的计费行为由零完成保险覆盖。
设置:将 Hermes Agent 连接到 OpenRouter
如果您尚未安装 Hermes,请从以下步骤开始:
curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash 它支持 Linux、macOS、WSL2 和 Termux。通过原生 PowerShell 对 Windows 的支持仍处于早期测试阶段。
安装完成后,将 Hermes Agent 连接到 OpenRouter 只需两个步骤:创建一个 API 密钥,然后配置 Hermes 使用该密钥。配置完成后,Hermes Agent 会通过 OpenRouter 进行身份验证,并使用您在配置中指定的模型 slug 执行所有任务。
上下文长度是一个硬性约束。大多数设置至少需要 64K token 的上下文,如果上下文窗口更小,智能体可能会拒绝启动。
在开始任何对话之前,系统提示词和工具架构已经占用了上下文窗口的很大一部分。您可以在 openrouter.ai/models 查看任何模型支持的上下文大小。