跳转到主要内容
两道相互独立的控制,保护平台与你的花费。二者都返回 OpenAI 兼容的错误信封,标准 SDK 能直接识别。

请求限流(按 key)

每把 API key 限制每分钟请求数(默认 60)。超额返回 HTTP 429,带 Retry-AfterX-RateLimit-* 头:
窗口按服务副本计数,故公布的 per-key 数值是下限而非精确全局上限。需要提高某 key 的限额,联系 Mirobody Support

用量配额(按账户,月度)

每个账户有月度用量上限(以 billed 模型用量的 USD 计)。当当月用量达到上限时,/v1 请求被拒,返回 HTTP 429 insufficient_quota,次月自动重置:
该上限覆盖账户名下所有 key 的合计。成本按 provider-true(billed)token 乘档位单价计量,命中提示词缓存的部分按更低的缓存价计(每次响应的 usage.billed_tokens 可见)。提高或解除上限,联系 Mirobody Support

客户端节流

客户端退避

  • 收到 429 rate_limit_exceeded,遵守 Retry-After——切勿立即重试;连续两次后退避翻倍,上限 5 分钟。
  • 收到 429 insufficient_quota,不要重试——配额按月重置或经支持调整;把它反馈给操作方。