> ## Documentation Index
> Fetch the complete documentation index at: https://veniceai-mintlify-de47a659.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# Límites de velocidad

> Límites de velocidad de la API de Venice por nivel, las cabeceras que exponen la capacidad y la gestión de errores 429.

Los límites de velocidad varían según el modelo y el nivel. Los límites predeterminados que aparecen a continuación son una referencia útil, pero el endpoint `/api_keys/rate_limits` de la API es la forma canónica de obtener tus límites actuales. Puedes consultar tus límites exactos en cualquier momento:

<CardGroup cols={2}>
  <Card title="Ver tus límites" icon="gauge-high" href="/es/api-reference/endpoint/api_keys/rate_limits?playground=open">
    Playground interactivo
  </Card>

  <Card title="Registros de límites" icon="clock-rotate-left" href="/es/api-reference/endpoint/api_keys/rate_limit_logs?playground=open">
    Mira qué solicitudes alcanzaron los límites
  </Card>
</CardGroup>

```bash theme={null}
curl https://api.venice.ai/api/v1/api_keys/rate_limits \
  -H "Authorization: Bearer $VENICE_API_KEY"
```

## Límites predeterminados

### Modelos de texto y de embeddings

Los modelos de texto y de embeddings se agrupan en cuatro tamaños. Cada tarjeta de modelo en la [página de Modelos](/es/models/text) muestra su insignia de tamaño. Todos los modelos de embeddings son XS.

| Tamaño | Solicitudes/min | Tokens/min | Solicitudes partner/min | Tokens partner/min |
| :----- | --------------: | ---------: | ----------------------: | -----------------: |
| XS     |             500 |  5.000.000 |                     500 |         10.000.000 |
| S      |             150 |  3.000.000 |                     300 |          6.000.000 |
| M      |             100 |  2.000.000 |                     200 |          4.000.000 |
| L      |             100 |  2.000.000 |                     150 |          3.000.000 |

<Note>
  Algunos modelos se ejecutan en infraestructura dedicada o de terceros y tienen límites que no se corresponden con estos cuatro tamaños. Llama a [`GET /api_keys/rate_limits`](/es/api-reference/endpoint/api_keys/rate_limits) para obtener los límites autoritativos por modelo de tu clave.
</Note>

### Modelos de imagen y audio

| Tipo                         | Solicitudes/min | Solicitudes partner/min |
| :--------------------------- | --------------: | ----------------------: |
| Imagen, escalado, inpainting |              20 |                      60 |
| Voz y transcripción          |              60 |                     120 |

### Modelos de vídeo y música

La generación de vídeo y de música no tiene límites de velocidad. Ambas se facturan por generación contra tu saldo de créditos, por lo que la restricción práctica es el coste y no un tope de solicitudes. Calcula primero el precio de un trabajo con [`POST /video/quote`](/es/api-reference/endpoint/video/quote) o [`POST /audio/quote`](/es/api-reference/endpoint/audio/quote).

## Gestión de errores

Las solicitudes fallidas (500, 503, 429) deben reintentarse con backoff exponencial.

Para los errores 429 en particular, comprueba la cabecera `x-ratelimit-reset-requests` para conocer la marca de tiempo Unix exacta en la que puedes reintentar. La mayoría de las bibliotecas HTTP tienen mecanismos de reintento integrados que lo gestionan automáticamente.

### Presupuestos de errores

Dos límites adicionales protegen la API frente a clientes que reintentan contra un muro. Ambos se cuentan por modelo y por clave de API en una ventana móvil de 30 segundos, y ambos devuelven `429`:

| Presupuesto                             |       Umbral | Se aplica a                       |
| :-------------------------------------- | -----------: | :-------------------------------- |
| Solicitudes fallidas                    |  50 por 30 s | Todos los endpoints               |
| Solicitudes de funciones no compatibles | 200 por 30 s | `/chat/completions`, `/responses` |

El segundo presupuesto cuenta las solicitudes que piden a un modelo una función que no admite, por ejemplo, solicitar visión o llamadas a herramientas a un modelo sin esa capacidad. Superar cualquiera de los dos presupuestos aparece en los [registros de límites de velocidad](/es/api-reference/endpoint/api_keys/rate_limit_logs) como `FAILED_REQUESTS` o `UNSUPPORTED_FEATURE_REQUESTS`.

Ambos devuelven un `customMessage` que indica el umbral que se ha superado:

```
Too many failed attempts (> 50) resulting in a non-success status code. Please wait 30 seconds and try again. See https://docs.venice.ai/api-reference/rate-limiting for more information.
```

Estas respuestas establecen `x-ratelimit-remaining` y `x-ratelimit-resets` en lugar de las cabeceras por ventana que se indican a continuación.

## Cabeceras de respuesta

Cada respuesta incluye estas cabeceras:

| Cabecera                         | Descripción                                           |
| :------------------------------- | :---------------------------------------------------- |
| `x-ratelimit-limit-requests`     | Máximo de solicitudes permitidas en la ventana actual |
| `x-ratelimit-remaining-requests` | Solicitudes restantes en la ventana actual            |
| `x-ratelimit-reset-requests`     | Marca de tiempo Unix cuando se restablece la ventana  |
| `x-ratelimit-limit-tokens`       | Máximo de tokens permitidos por minuto                |
| `x-ratelimit-remaining-tokens`   | Tokens restantes en el minuto actual                  |
| `x-ratelimit-reset-tokens`       | Segundos hasta que se restablece el límite de tokens  |

El endpoint `/crypto/rpc/{network}` usa sus propios límites y sus propias cabeceras `X-RateLimit-Limit`, `X-RateLimit-Remaining` y `X-RateLimit-Reset`, que solo se establecen en las respuestas 429. Consulta [Crypto RPC](/es/api-reference/endpoint/crypto/rpc) para más detalles.

## Nivel Partner

Los límites de partner se muestran junto a los predeterminados en las tablas anteriores.

Si estás alcanzando consistentemente tus límites de velocidad y tus patrones de uso muestran **demanda sostenida en el tiempo**, ponte en contacto para hablar sobre acceso de partner: [api@venice.ai](mailto:api@venice.ai).

Los límites del nivel Partner pueden ajustarse según tus necesidades específicas.
