Skip to content

API 报错 429:请求太频繁 ​

429 是「慢一点」的意思,失败的请求不扣费。 过 1–2 分钟再试通常就好了;如果是你自己的程序或工具同时发了很多请求(批量翻译、并行任务),把并发调低、加上重试间隔。报错里写的是「API key 额度已用完」的话,那是额度问题,看 余额不足 / 额度已用完。

更新于 2026-10。

按报错内容判断 ​

报错原因处理
「同时进行的请求数已达你的账号 / 这个 API Key 的并发上限」同一时间进行中的请求太多等前面的请求完成;在工具里调低并发数
「排队的请求太多,请等正在进行的请求完成后再试」并发满了之后排队的请求也满了同上,减少同时发出的请求
「上游模型服务限流中,请过 1–2 分钟再试」上游模型服务临时限流等 1–2 分钟重试,或换一个模型
「All available accounts are currently rate-limited」(rate_limit_error)你分组里的上游账号都在限流稍后重试
「Too many invalid authentication attempts」短时间内用错误的 Key 请求太多次先改对 Key,见 401 报错
「API key 额度已用完」(insufficient_quota)Key 额度上限到了,不是限流见 余额不足 / 额度已用完

503:上游繁忙、暂时没有可用账号 ​

这几种是 502 / 503,原因和 429 类似,都是上游暂时处理不过来,同样不扣费:

报错处理
「上游模型服务过载」「上游模型服务暂时不可用(已自动切换账号重试仍失败)」稍后重试
「…暂时没有可处理模型 … 请求的上游账号:可能是账号繁忙,也可能是这个 Key 的分组不支持所选模型」稍后重试;一直出现就检查模型名,见 模型不存在 / 分组不支持模型
「服务繁忙,请稍后重试」稍后重试

在常用工具里降低并发 ​

  • 沉浸式翻译: 在翻译服务的高级设置里调低「每秒最大请求数」,见 沉浸式翻译配置教程。
  • Codex、OpenCode 等编程工具: 少开并行任务和子代理;一个任务跑完再开下一个。
  • 自己写的批量脚本: 用固定数量的并发(比如 3–5 个),不要一次把几百个请求全发出去。

自己写代码时加上重试 ​

遇到 429、502、503 时等一会儿再重试,每次等的时间翻倍(指数退避)。OpenAI 官方 SDK 自带重试,调大次数即可:

python
from openai import OpenAI

client = OpenAI(
    base_url="https://hivegpt.cn/v1",
    api_key="sk-你的Key",
    max_retries=5,   # 429 / 5xx 自动重试,间隔逐次加长
    timeout=120,
)

Node.js 的 openai 包同样有 maxRetries 参数。自己发 HTTP 请求时,按「等 2 秒、4 秒、8 秒……」的节奏重试,最多 5 次左右。

一直 429 怎么办 ​

如果几分钟后、并发也降下来了还是 429:

  1. 看 使用记录,确认是不是有别的工具在用同一个 Key 频繁请求。
  2. 给不同的工具分别建 Key,方便看清是谁在占用。
  3. 问首页右下角的智能客服,把报错原文贴给它。

其他报错看 报错速查。

代码示例在页面里运行时使用 HiveGPT 的模型接口。延伸阅读来自 JavaGuide(Apache-2.0),版权归原作者。