token 是什么,怎么算钱
token 是大模型读写文字的计量单位,中文大约 1.5 个字算 1 个 token。 每次请求的费用 = 输入 token × 输入单价 + 输出 token × 输出单价(命中缓存的输入按更便宜的缓存单价算)。HiveGPT 按模型的官方美元标价计费,充值 ¥1 = $1 额度,所以下面算出来的美元数,基本就是你要花的人民币数。
一段文字是多少 token
用 GPT 系列模型的分词器实测:
| 内容 | 字符数 | token 数 | 大约 |
|---|---|---|---|
| 一段中文 | 69 字 | 45 | 1.5 个汉字 ≈ 1 token |
| 同样意思的英文 | 235 个字母 | 40 | 6 个字母 ≈ 1 token |
| 一小段 Python 代码 | 50 个字符 | 20 | 2.5 个字符 ≈ 1 token |
换算成常见的量:1000 个汉字 ≈ 650 token,一篇 3000 字的文章约 2000 token。不同模型的分词方式略有不同,实际数量以返回的 usage 为准。
三种 token,单价不同
| 类型 | 是什么 | gpt-5.5 标价(每 100 万 token) |
|---|---|---|
| 输入 token | 你发过去的内容:提示词、系统消息、之前的对话、文件内容 | $5 |
| 缓存输入 token | 和前几次请求开头相同的输入,上游会缓存,按便宜的价格算 | $0.5 |
| 输出 token | 模型写出来的内容,推理模型的思考过程也算在里面 | $30 |
输出比输入贵得多,而缓存的输入只要原价的十分之一。
实际花多少:三个例子
1. 问一个问题
问题加系统提示约 200 token,回答 800 字约 530 token:
200 × $5 / 100万 = $0.001
530 × $30 / 100万 = $0.016
合计 ≈ $0.017,约 ¥0.022. 聊了 10 轮的对话
模型不记得上一轮,每次请求都要把之前的对话一起发过去。第 10 轮时,输入可能已经有 6000 token:
6000 × $5 / 100万 = $0.030 ← 前面的对话越长,这部分越贵
500 × $30 / 100万 = $0.015
这一轮 ≈ $0.045所以换话题时开一个新对话,比在一个很长的对话里一直聊便宜得多。
3. 一次 Codex 编程请求
HiveGPT 上 Codex 请求的中位数大约是:新输入 1265 token、缓存输入 12 万 token(项目文件和之前的上下文)、输出 235 token:
1265 × $5 / 100万 = $0.006
120000 × $0.5 / 100万 = $0.060 ← 走缓存;不走缓存要 $0.60
235 × $30 / 100万 = $0.007
合计 ≈ $0.073编程工具每一步都会带上大量上下文,缓存能省下大约九成的输入费用。同一个任务连续做、少开新会话,缓存命中率更高。
画图怎么算
gpt-image-2 画图按张计费,尺寸越大、质量越高越贵,和上面的文字 token 分开算。先用低质量试构图,满意了再出高质量。见 价格页。
在哪里看用量
控制台「使用记录」:每次请求的模型、输入 / 输出 / 缓存 token 数和扣费,见 使用记录。
接口返回的
usage:json"usage": { "prompt_tokens": 210, "completion_tokens": 532, "total_tokens": 742 }Python 里是
resp.usage,见 Python 完整示例。
订阅也按 token 扣
买了订阅后,每次请求按同样的方式算出美元金额,从订阅的每日 / 每周 / 每月额度里扣;额度用完后同一个 Key 自动改用余额。哪种更划算,看 订阅还是按量 的估算。
省钱的 6 个办法
- 换话题就开新对话。 长对话每一轮都在重复付前面的钱。
- 简单任务用便宜的模型。 翻译、分类、提取信息用小模型就够,单价可能只有大模型的几十分之一,看 模型广场。
- 限制输出长度。 在提示词里写「100 字以内」,或在接口里设
max_completion_tokens。 - 调低推理强度。 推理模型的思考过程按输出计费,简单问题用低推理强度。
- 别把整份文件都塞进去。 只发和问题相关的部分;做知识库用 RAG。
- 给 Key 设额度上限。 在 API 密钥 页给每个工具单独建 Key 并设上限,哪个工具花得多一目了然。
常见问题
为什么我只问了一句,用了几千 token? 工具会在你的话前面加上系统提示词、之前的对话和文件内容,这些都算输入。编程工具和带知识库的应用尤其明显。
失败的请求扣钱吗? 不扣。报错、限流、超时的请求都不计费,见 报错速查。
为什么不同模型差这么多? 每个模型有自己的官方标价,大模型和推理模型更贵。HiveGPT 按标价计算,不同模型的单价以模型广场为准。