跳转到内容

计费

计费说明

NoviaHub 怎么收费:计费方式、按 Token 的算法、分组倍率、预扣与结算,以及如何核对每一笔费用。

NoviaHub 按实际用量收费,用多少扣多少。费用从账户余额里扣除,余额可以在钱包里查看和充值。每一次调用花了多少钱,都能在使用日志里查到。

  • 余额单位:界面上的余额、价格和扣费金额都以美元($)显示。
  • 单价:每个模型的价格在 模型&价格 页面公开。页面上的价格已经算上了分组倍率,页面提示为「价格已按各分组倍率计算。」

截至 2026-09-29,NoviaHub 上的所有模型都采用「动态计费」:模型&价格 的模型列表和模型详情里都会显示「动态计费」标签,使用日志详情里的「计费模式」也显示「动态计费」,并用「命中阶梯」标出这次用的是哪一档价格(例如 standard)。

「动态计费」的意思是价格由一条计费规则算出,不代表价格随时浮动。大多数模型的规则就是固定的按 Token 单价。按规则的不同,线上目前有下面几种:

计价方式 怎么收费 2026-09-29 线上的例子
按 Token 输入、输出、缓存读写各按每 100 万(1M)Token 的单价计费 Claude 系列、kimi-k3、glm-5.3-flash、大部分 Gemini 模型、gpt-image-2
按输入长度分档 输入总长度超过门槛时,整次请求改按更高一档的单价计费;模型详情的价格表会标出「阶梯定价」 GPT 系列(272,000 Token 以内为 standard 档,超过为 long_context 档);gemini-3.1-pro-low、gemini-pro-agent(门槛 200,000 Token)
按时段 不同时段单价不同;模型卡片上会注明「当前时段价格」 DeepSeek 系列:UTC 时间周一至周五 01:00–04:00、06:00–10:00 为 peak 档,其余时间为 off_peak 档
按张 每生成一张图片收固定价格,按分辨率分档 gemini-3.1-flash-image,见图片生成

计费规则和单价都可能调整,以模型详情页为准。

Token 是什么? 模型处理文字的最小单位,大致可以理解为「一小段字」。一段文字折合多少 Token,因模型而异,没有固定的换算比例。每次调用的准确数量以模型返回的用量为准,在使用日志里可以查到。

一次调用的费用 =(以下各项之和)× 分组倍率:

  • 未命中缓存的输入 Token × 输入单价
  • 缓存读取 Token × 缓存读取单价
  • 缓存写入 Token × 缓存写入单价
  • 输出 Token × 输出单价

如果模型对图片、音频输入单独定价(价格表里的「图像输入」等栏),这部分按对应单价另算,不再计入普通输入。缓存的含义见提示缓存。

下面是本地测试环境里的一条真实日志。价格是测试用的示例价格,不代表线上当前价格;测试环境用的是旧式单价设置,所以截图里的「计费模式」是「按 Token」,线上会显示「动态计费」,但按 Token 计价的算法相同:

  • 模型 deepseek-v4-flash
  • 输入 12 个 Token,输出 7 个 Token,没有用到缓存
  • 输入单价 $0.25 / 1M Token,输出单价 $1 / 1M Token,分组倍率 1

费用 =(12 × 0.25 + 7 × 1)÷ 1,000,000 × 1 = 0.00001 美元,也就是日志里显示的「总费用」$0.00001。

日志详情:输入 Token 12、输出 Token 7,计费模式「按 Token」,输入 $0.25/M、输出 $1/M、分组倍率 1.0000x、总费用 $0.00001日志详情:输入 Token 12、输出 Token 7,计费模式「按 Token」,输入 $0.25/M、输出 $1/M、分组倍率 1.0000x、总费用 $0.00001

「分组」决定一次调用走哪一组线路、乘以哪个倍率。NoviaHub 目前只有「默认分组」一个分组,倍率为 1,也就是按页面上的价格原价计费。如果以后增加了分组,模型详情的价格表会按分组分别列出价格。

  1. 请求开始前:NoviaHub 会先按输入内容估算这次大概要花多少,确认余额够用,并从余额里暂时扣下这笔钱(预扣)。如果账户余额高于 $10,并且这把 API 密钥是「无限配额」、或者剩余额度也高于 $10,系统会跳过预扣,直接在请求结束后按实际用量扣费。
  2. 请求结束后:按模型实际返回的用量计算真实费用,多扣的退回,少扣的补扣。
  3. 请求失败时:如果这次请求整个失败了(例如上游报错),预扣的钱会全部退回,不收费。

余额不够时,请求会直接被拒绝,返回 HTTP 403,错误码 insufficient_user_quota:

  • 余额已经是 0 或负数:提示「用户额度不足, 剩余额度: …」;
  • 余额大于 0,但少于这次的预扣估算:提示「预扣费额度失败, 用户剩余额度: …, 需要预扣费额度: …」。

所以余额所剩不多时,可能出现「余额看起来还有,但请求被拒」的情况,充值后即可恢复。

  • 费用从账户余额里扣,不会从某一把 API 密钥里扣。
  • 给 API 密钥设置的「额度」只是一个花费上限:这把密钥累计花到上限后,状态变为「已耗尽」,不能再用;但它花的钱仍然是从账户余额里扣的。
  • 开启「无限配额」的密钥没有上限,但余额用完后同样无法调用。

详见API 密钥。

  1. 打开控制台的使用日志,每一行就是一次调用,「费用」一列是这次的花费。
  2. 点「详情」,在「计费详情」里可以看到计费模式、命中的档位、各项单价、分组倍率和总费用;在「Token 明细」里可以看到输入、输出、缓存各用了多少 Token。
  3. 在钱包顶部,「总用量」是累计花费,「当前余额」是剩余金额。

在钱包页面可以在线充值(Stripe、支付宝、微信支付、Heleket 加密货币),也可以使用兑换码,详见钱包与充值。