平台对请求做两级速率限制:API Key 级与用户级(同一用户名下多个 Key 共享用户级额度)。具体 RPM / QPS 额度随套餐配置,以控制台展示为准。
超限响应
触发限流时返回 HTTP 429,错误体为 OpenAI 兼容格式:
{ "error": { "message": "rate limit exceeded", "type": "rate_limit_error", "code": "rate_limited" }}其他与频率相关的错误码:
| HTTP | code | 含义 |
|---|---|---|
| 429 | rate_limited |
触发平台 Key / 用户级限流 |
| 429 | key_quota_exhausted |
Key / 用户额度已用尽 |
| 402 | user_balance_exhausted |
账户余额不足 |
| 429 | upstream_rate_limited |
上游模型服务全部繁忙(重试窗口内均返回 429) |
| 502 | upstream_exhausted |
上游服务多次尝试后仍不可用 |
重试建议
- 收到 429 / 502 时采用指数退避 + 随机抖动重试(如 1s → 2s → 4s)
- 异步任务(视频等)的状态轮询建议间隔 5–10 秒——轮询过密不会加速生成
- 长同步请求(生图)不要因客户端超时而立即重发,先确认上一个请求已结束,避免重复计费
