/api_keys/rate_limits API 端点是获取您当前限制的权威方式。您可以随时查看您的确切限制:
查看您的限制
交互式 playground
速率限制日志
查看哪些请求达到了限制
默认限制
文本和嵌入模型
文本和嵌入模型按规模分为四个等级。模型页面上的每个模型卡片都会显示其等级徽章。所有嵌入模型均为 XS。部分模型运行在专用或第三方基础设施上,其限制并不对应这四个等级。请调用
GET /api_keys/rate_limits 获取您的密钥上每个模型的权威限制。图像和音频模型
视频和音乐模型
视频和音乐生成不受速率限制。两者均按每次生成从您的积分余额中计费,因此实际的约束是成本而非请求上限。请先使用POST /video/quote 或 POST /audio/quote 对任务进行估价。
处理错误
失败的请求(500、503、429)应使用指数退避进行重试。 对于 429 错误,请查看x-ratelimit-reset-requests 响应头以获取您可以重试的确切 Unix 时间戳。大多数 HTTP 库都内置了自动处理此情况的重试机制。
错误预算
另有两个限制用于保护 API,防止客户端反复重试撞墙。两者均按每个 API 密钥、每个模型在滚动的 30 秒窗口内计数,并且都会返回429:
第二个预算统计的是向模型请求其不支持的功能的请求。例如,向不具备视觉或工具调用能力的模型请求这些功能。超出任一预算都会在速率限制日志中显示为
FAILED_REQUESTS 或 UNSUPPORTED_FEATURE_REQUESTS。
两者都会返回一个 customMessage,指明触发的阈值:
x-ratelimit-remaining 和 x-ratelimit-resets,而非下面的按窗口计算的响应头。
响应头
每个响应都包含以下响应头:/crypto/rpc/{network} 端点使用自己的限制以及自己的 X-RateLimit-Limit、X-RateLimit-Remaining 和 X-RateLimit-Reset 响应头,这些响应头仅在 429 响应中设置。详情请参阅 Crypto RPC。