命令行 Agent
Hermes
把 Nous Research 的 Hermes Agent 配置为使用 NoviaHub 这个自定义 OpenAI 兼容端点。
Hermes Agent 是 Nous Research 推出的 AI Agent,可以在终端里对话使用,也提供桌面应用,并能接入 Telegram、Discord、Slack 等消息平台(hermes gateway setup)以及编辑器(hermes acp)。官方说明:Hermes Agent 可以对接任何 OpenAI 兼容的 API 端点,只要服务端实现了 /v1/chat/completions 就能用。NoviaHub 就按「自定义端点」(Custom endpoint)的方式接入。
安装 Hermes Agent
Section titled “安装 Hermes Agent”curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash在 PowerShell 里运行:
iex (irm https://hermes-agent.nousresearch.com/install.ps1)以上是只装命令行版本的方式。官方也提供桌面应用:macOS 为 DMG 安装包(只支持 Apple Silicon,不支持 Intel 芯片的 Mac),Windows 为 .appinstaller,详见 安装文档。
安装完成后重新加载终端配置(source ~/.bashrc 或 source ~/.zshrc),然后就可以运行 hermes 了。
配置 NoviaHub
Section titled “配置 NoviaHub”下面以 deepseek-v4-flash 为例。两种方式任选其一。
方式一:用 hermes model 向导(官方推荐)
Section titled “方式一:用 hermes model 向导(官方推荐)”-
在终端(不是在 Hermes 对话里)运行:
终端窗口 hermes model -
选择「Custom endpoint (self-hosted / VLLM / etc.)」。
-
按提示依次填写:
提示 填写内容 API base URL https://noviahub.com/v1(要带/v1)API key 你的 NoviaHub 密钥(以 sk-开头)Model name deepseek-v4-flash -
向导还会询问 API 模式和上下文长度:
- API 模式(提示为「Select API compatibility mode」):选「Chat Completions」(配置里记为
chat_completions)。 - 上下文长度:填模型的上下文长度(在 模型&价格 的模型详情里看「上下文」一栏;
deepseek-v4-flash在 2026-09-28 标注为 1,000,000)。原因见下面的「注意事项」。
- API 模式(提示为「Select API compatibility mode」):选「Chat Completions」(配置里记为
方式二:手动编辑配置文件
Section titled “方式二:手动编辑配置文件”-
保存密钥。 运行下面的命令,Hermes 会把它保存到
~/.hermes/.env(大写下划线形式的名字都会写进.env,不会写进config.yaml):终端窗口 hermes config set NOVIAHUB_API_KEY "sk-..." -
编辑
~/.hermes/config.yaml,写入(或修改)model部分:~/.hermes/config.yaml model:default: deepseek-v4-flashprovider: custombase_url: https://noviahub.com/v1key_env: NOVIAHUB_API_KEYapi_mode: chat_completionscontext_length: 1000000配置项 作用 default默认使用的模型 ID,必须和 NoviaHub 上的模型 ID 完全一致。 provider填 custom,表示自定义端点。base_url接口地址,要带 /v1:https://noviahub.com/v1。key_env存放密钥的环境变量名(用来代替直接写 api_key)。api_mode请求协议, chat_completions表示 Chat Completions。可以不写:Hermes 对 NoviaHub 这样的地址默认就用 Chat Completions。context_length模型的上下文长度,明确写出来,原因见下面的「注意事项」。 -
运行
hermes启动。
-
运行
hermes,启动后会显示欢迎横幅,里面有当前使用的模型、可用工具和技能。 -
发一句容易核对的话,例如「用一句话介绍你自己」。收到回复,说明配置成功。
-
如果有问题,运行
hermes doctor检查配置。 -
到 NoviaHub 控制台的 使用日志 查看这次调用和费用。
- 在对话中切换:输入
/model custom:模型ID,例如/model custom:kimi-k3。 - 注意区分两个命令:
hermes model(在终端里运行)是完整的设置向导,用来添加服务商、填写密钥;/model(在对话里输入)只能在已经配置好的服务商和模型之间切换,不能添加新的服务商。 - 选哪些模型:Hermes 通过 Chat Completions 接口调用,请选择在 模型&价格 上带有「Chat」标签的模型。2026-09-28 线上的全部模型都带有这个标签。
- 至少需要 64,000 tokens 的上下文。 官方说明:带工具使用 Hermes Agent 时,模型上下文至少要 64,000 tokens,更小的窗口会在启动时被拒绝。选模型前先在模型详情里看「上下文」。
- 建议明确写出
context_length。 Hermes 会尝试从端点的/v1/models自动获取上下文长度,但 NoviaHub 的/v1/models返回的模型信息里不包含上下文长度。官方给出的解决办法就是在config.yaml里用context_length明确指定。 - 手动配置时用 Chat Completions。 Hermes 源码里,
provider: custom的配置如果地址不是 OpenAI 官方等少数几个地址,会忽略api_mode: codex_responses,仍然用 Chat Completions 发请求。所以本页只介绍 Chat Completions,请选带「Chat」标签的模型。 OPENAI_BASE_URL对自定义端点不起作用。 这个环境变量只对 Hermes 内置的openai-api服务商生效;自定义端点请用hermes model或model.base_url设置。
以下资料查阅于 2026-09-28 至 2026-09-29:
- 安装:https://hermes-agent.nousresearch.com/docs/getting-started/installation
- 快速开始(验证、
hermes doctor):https://hermes-agent.nousresearch.com/docs/getting-started/quickstart - 服务商配置(自定义端点、
/model、上下文长度):https://hermes-agent.nousresearch.com/docs/integrations/providers - 配置说明(
hermes config set、.env):https://hermes-agent.nousresearch.com/docs/user-guide/configuration model.api_mode的取值、向导里的 API 模式选项、自定义端点忽略codex_responses:Hermes Agent 源码hermes_cli/runtime_provider.py(_VALID_API_MODES、_resolve_plain_custom_api_mode)、hermes_cli/main_provider_setup.py(_CUSTOM_API_MODES)、hermes_cli/model_setup_flows_custom.py