Skip to content

token 是什么,怎么算钱 ​

token 是大模型读写文字的计量单位,中文大约 1.5 个字算 1 个 token。 每次请求的费用 = 输入 token × 输入单价 + 输出 token × 输出单价(命中缓存的输入按更便宜的缓存单价算)。HiveGPT 按模型的官方美元标价计费,充值 ¥1 = $1 额度,所以下面算出来的美元数,基本就是你要花的人民币数。

更新于 2026-10。单价以 模型广场 和 价格页 为准,下面的例子用 gpt-5.5 的标价演示。

一段文字是多少 token ​

用 GPT 系列模型的分词器实测:

内容字符数token 数大约
一段中文69 字451.5 个汉字 ≈ 1 token
同样意思的英文235 个字母406 个字母 ≈ 1 token
一小段 Python 代码50 个字符202.5 个字符 ≈ 1 token

换算成常见的量:1000 个汉字 ≈ 650 token,一篇 3000 字的文章约 2000 token。不同模型的分词方式略有不同,实际数量以返回的 usage 为准。

三种 token,单价不同 ​

类型是什么gpt-5.5 标价(每 100 万 token)
输入 token你发过去的内容:提示词、系统消息、之前的对话、文件内容$5
缓存输入 token和前几次请求开头相同的输入,上游会缓存,按便宜的价格算$0.5
输出 token模型写出来的内容,推理模型的思考过程也算在里面$30

输出比输入贵得多,而缓存的输入只要原价的十分之一。

实际花多少:三个例子 ​

1. 问一个问题

问题加系统提示约 200 token,回答 800 字约 530 token:

text
200 × $5 / 100万   = $0.001
530 × $30 / 100万  = $0.016
合计 ≈ $0.017,约 ¥0.02

2. 聊了 10 轮的对话

模型不记得上一轮,每次请求都要把之前的对话一起发过去。第 10 轮时,输入可能已经有 6000 token:

text
6000 × $5 / 100万  = $0.030   ← 前面的对话越长,这部分越贵
500 × $30 / 100万  = $0.015
这一轮 ≈ $0.045

所以换话题时开一个新对话,比在一个很长的对话里一直聊便宜得多。

3. 一次 Codex 编程请求

HiveGPT 上 Codex 请求的中位数大约是:新输入 1265 token、缓存输入 12 万 token(项目文件和之前的上下文)、输出 235 token:

text
1265 × $5 / 100万      = $0.006
120000 × $0.5 / 100万  = $0.060   ← 走缓存;不走缓存要 $0.60
235 × $30 / 100万      = $0.007
合计 ≈ $0.073

编程工具每一步都会带上大量上下文,缓存能省下大约九成的输入费用。同一个任务连续做、少开新会话,缓存命中率更高。

画图怎么算 ​

gpt-image-2 画图按张计费,尺寸越大、质量越高越贵,和上面的文字 token 分开算。先用低质量试构图,满意了再出高质量。见 价格页。

在哪里看用量 ​

  • 控制台「使用记录」:每次请求的模型、输入 / 输出 / 缓存 token 数和扣费,见 使用记录。

  • 接口返回的 usage:

    json
    "usage": { "prompt_tokens": 210, "completion_tokens": 532, "total_tokens": 742 }

    Python 里是 resp.usage,见 Python 完整示例。

订阅也按 token 扣 ​

买了订阅后,每次请求按同样的方式算出美元金额,从订阅的每日 / 每周 / 每月额度里扣;额度用完后同一个 Key 自动改用余额。哪种更划算,看 订阅还是按量 的估算。

省钱的 6 个办法 ​

  1. 换话题就开新对话。 长对话每一轮都在重复付前面的钱。
  2. 简单任务用便宜的模型。 翻译、分类、提取信息用小模型就够,单价可能只有大模型的几十分之一,看 模型广场。
  3. 限制输出长度。 在提示词里写「100 字以内」,或在接口里设 max_completion_tokens。
  4. 调低推理强度。 推理模型的思考过程按输出计费,简单问题用低推理强度。
  5. 别把整份文件都塞进去。 只发和问题相关的部分;做知识库用 RAG。
  6. 给 Key 设额度上限。 在 API 密钥 页给每个工具单独建 Key 并设上限,哪个工具花得多一目了然。

常见问题 ​

为什么我只问了一句,用了几千 token? 工具会在你的话前面加上系统提示词、之前的对话和文件内容,这些都算输入。编程工具和带知识库的应用尤其明显。

失败的请求扣钱吗? 不扣。报错、限流、超时的请求都不计费,见 报错速查。

为什么不同模型差这么多? 每个模型有自己的官方标价,大模型和推理模型更贵。HiveGPT 按标价计算,不同模型的单价以模型广场为准。

代码示例在页面里运行时使用 HiveGPT 的模型接口。延伸阅读来自 JavaGuide(Apache-2.0),版权归原作者。