跳转到内容

命令行 Agent

Hermes

把 Nous Research 的 Hermes Agent 配置为使用 NoviaHub 这个自定义 OpenAI 兼容端点。

Hermes Agent 是 Nous Research 推出的 AI Agent,可以在终端里对话使用,也提供桌面应用,并能接入 Telegram、Discord、Slack 等消息平台(hermes gateway setup)以及编辑器(hermes acp)。官方说明:Hermes Agent 可以对接任何 OpenAI 兼容的 API 端点,只要服务端实现了 /v1/chat/completions 就能用。NoviaHub 就按「自定义端点」(Custom endpoint)的方式接入。

  • 有一个 NoviaHub 账户,并且已经创建了 API 密钥,见 API 密钥。
  • 账户里有余额,见 钱包与充值。
终端窗口
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

以上是只装命令行版本的方式。官方也提供桌面应用:macOS 为 DMG 安装包(只支持 Apple Silicon,不支持 Intel 芯片的 Mac),Windows 为 .appinstaller,详见 安装文档。

安装完成后重新加载终端配置(source ~/.bashrc 或 source ~/.zshrc),然后就可以运行 hermes 了。

下面以 deepseek-v4-flash 为例。两种方式任选其一。

方式一:用 hermes model 向导(官方推荐)

Section titled “方式一:用 hermes model 向导(官方推荐)”
  1. 在终端(不是在 Hermes 对话里)运行:

    终端窗口
    hermes model
  2. 选择「Custom endpoint (self-hosted / VLLM / etc.)」。

  3. 按提示依次填写:

    提示 填写内容
    API base URL https://noviahub.com/v1(要带 /v1)
    API key 你的 NoviaHub 密钥(以 sk- 开头)
    Model name deepseek-v4-flash
  4. 向导还会询问 API 模式和上下文长度:

    • API 模式(提示为「Select API compatibility mode」):选「Chat Completions」(配置里记为 chat_completions)。
    • 上下文长度:填模型的上下文长度(在 模型&价格 的模型详情里看「上下文」一栏;deepseek-v4-flash 在 2026-09-28 标注为 1,000,000)。原因见下面的「注意事项」。
  1. 保存密钥。 运行下面的命令,Hermes 会把它保存到 ~/.hermes/.env(大写下划线形式的名字都会写进 .env,不会写进 config.yaml):

    终端窗口
    hermes config set NOVIAHUB_API_KEY "sk-..."
  2. 编辑 ~/.hermes/config.yaml,写入(或修改)model 部分:

    ~/.hermes/config.yaml
    model:
    default: deepseek-v4-flash
    provider: custom
    base_url: https://noviahub.com/v1
    key_env: NOVIAHUB_API_KEY
    api_mode: chat_completions
    context_length: 1000000
    配置项 作用
    default 默认使用的模型 ID,必须和 NoviaHub 上的模型 ID 完全一致。
    provider 填 custom,表示自定义端点。
    base_url 接口地址,要带 /v1:https://noviahub.com/v1。
    key_env 存放密钥的环境变量名(用来代替直接写 api_key)。
    api_mode 请求协议,chat_completions 表示 Chat Completions。可以不写:Hermes 对 NoviaHub 这样的地址默认就用 Chat Completions。
    context_length 模型的上下文长度,明确写出来,原因见下面的「注意事项」。
  3. 运行 hermes 启动。

  1. 运行 hermes,启动后会显示欢迎横幅,里面有当前使用的模型、可用工具和技能。

  2. 发一句容易核对的话,例如「用一句话介绍你自己」。收到回复,说明配置成功。

  3. 如果有问题,运行 hermes doctor 检查配置。

  4. 到 NoviaHub 控制台的 使用日志 查看这次调用和费用。

  • 在对话中切换:输入 /model custom:模型ID,例如 /model custom:kimi-k3。
  • 注意区分两个命令:hermes model(在终端里运行)是完整的设置向导,用来添加服务商、填写密钥;/model(在对话里输入)只能在已经配置好的服务商和模型之间切换,不能添加新的服务商。
  • 选哪些模型:Hermes 通过 Chat Completions 接口调用,请选择在 模型&价格 上带有「Chat」标签的模型。2026-09-28 线上的全部模型都带有这个标签。
  • 至少需要 64,000 tokens 的上下文。 官方说明:带工具使用 Hermes Agent 时,模型上下文至少要 64,000 tokens,更小的窗口会在启动时被拒绝。选模型前先在模型详情里看「上下文」。
  • 建议明确写出 context_length。 Hermes 会尝试从端点的 /v1/models 自动获取上下文长度,但 NoviaHub 的 /v1/models 返回的模型信息里不包含上下文长度。官方给出的解决办法就是在 config.yaml 里用 context_length 明确指定。
  • 手动配置时用 Chat Completions。 Hermes 源码里,provider: custom 的配置如果地址不是 OpenAI 官方等少数几个地址,会忽略 api_mode: codex_responses,仍然用 Chat Completions 发请求。所以本页只介绍 Chat Completions,请选带「Chat」标签的模型。
  • OPENAI_BASE_URL 对自定义端点不起作用。 这个环境变量只对 Hermes 内置的 openai-api 服务商生效;自定义端点请用 hermes model 或 model.base_url 设置。

以下资料查阅于 2026-09-28 至 2026-09-29: