Skip to main content
两套相互独立的控制机制保护着平台与你的支出,二者都会返回 OpenAI 兼容的错误信封,标准 SDK 能直接读懂它们。

请求限流(按 key)

每把 API key 都有一个每分钟请求数设置(默认 60)。同一限额适用于所有需要认证的 /v1 端点,而不是给每条路径单独分配额度。超出限额会返回 HTTP 429,并带上 Retry-After 与 X-RateLimit-* 响应头:
可将按 key 的限额视为下限:短时突发可能略微超过,请勿把它当作精确的全局上限。需要提高某 key 的限额,联系 Mirobody Support。

账户月度上限

托管环境可按 USD 为账户设置月度上限。启用后,当月计量用量一达到上限,需要认证的 /v1 请求就会返回 HTTP 429 insufficient_quota,直到下一个自然月,或支持人员上调上限:
上限按账户名下所有 key 的合计用量计算。错误消息会返回当前配置的上限与当月计量金额。确认或调整账户上限,请联系 Mirobody Support。

客户端节流

同一 key 的合计请求速率应低于其配置的 RPM。流式调用在请求开始时计数。结构化记录应批量写入同一个 POST /v1/data 请求(最多 500 条);文件上传后,在其文本就绪前不要密集轮询。

客户端退避

  • 收到 429 rate_limit_exceeded,遵守 Retry-After:切勿立即重试;连续两次后退避翻倍,上限 5 分钟。
  • 收到 429 insufficient_quota,不要重试:配额按月重置或经支持调整;把它反馈给运维方。

另见