/api_keys/rate_limits de la API es la forma canónica de obtener tus límites actuales. Puedes consultar tus límites exactos en cualquier momento:
Ver tus límites
Playground interactivo
Registros de límites
Mira qué solicitudes alcanzaron los límites
Límites predeterminados
Modelos de texto y de embeddings
Los modelos de texto y de embeddings se agrupan en cuatro tamaños. Cada tarjeta de modelo en la página de Modelos muestra su insignia de tamaño. Todos los modelos de embeddings son XS.Algunos modelos se ejecutan en infraestructura dedicada o de terceros y tienen límites que no se corresponden con estos cuatro tamaños. Llama a
GET /api_keys/rate_limits para obtener los límites autoritativos por modelo de tu clave.Modelos de imagen y audio
Modelos de vídeo y música
La generación de vídeo y de música no tiene límites de velocidad. Ambas se facturan por generación contra tu saldo de créditos, por lo que la restricción práctica es el coste y no un tope de solicitudes. Calcula primero el precio de un trabajo conPOST /video/quote o POST /audio/quote.
Gestión de errores
Las solicitudes fallidas (500, 503, 429) deben reintentarse con backoff exponencial. Para los errores 429 en particular, comprueba la cabecerax-ratelimit-reset-requests para conocer la marca de tiempo Unix exacta en la que puedes reintentar. La mayoría de las bibliotecas HTTP tienen mecanismos de reintento integrados que lo gestionan automáticamente.
Presupuestos de errores
Dos límites adicionales protegen la API frente a clientes que reintentan contra un muro. Ambos se cuentan por modelo y por clave de API en una ventana móvil de 30 segundos, y ambos devuelven429:
El segundo presupuesto cuenta las solicitudes que piden a un modelo una función que no admite, por ejemplo, solicitar visión o llamadas a herramientas a un modelo sin esa capacidad. Superar cualquiera de los dos presupuestos aparece en los registros de límites de velocidad como
FAILED_REQUESTS o UNSUPPORTED_FEATURE_REQUESTS.
Ambos devuelven un customMessage que indica el umbral que se ha superado:
x-ratelimit-remaining y x-ratelimit-resets en lugar de las cabeceras por ventana que se indican a continuación.
Cabeceras de respuesta
Cada respuesta incluye estas cabeceras:
El endpoint
/crypto/rpc/{network} usa sus propios límites y sus propias cabeceras X-RateLimit-Limit, X-RateLimit-Remaining y X-RateLimit-Reset, que solo se establecen en las respuestas 429. Consulta Crypto RPC para más detalles.