> ## Documentation Index
> Fetch the complete documentation index at: https://veniceai-mintlify-de47a659.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# Limites de débit

> Limites de débit de l'API Venice par niveau, en-têtes exposant la capacité et gestion des erreurs 429.

Les limites de débit varient selon le modèle et le niveau. Les limites par défaut ci-dessous constituent une référence utile, mais l'endpoint API `/api_keys/rate_limits` est la manière canonique de récupérer vos limites actuelles. Vous pouvez vérifier vos limites exactes à tout moment :

<CardGroup cols={2}>
  <Card title="Voir vos limites" icon="gauge-high" href="/fr/api-reference/endpoint/api_keys/rate_limits?playground=open">
    Playground interactif
  </Card>

  <Card title="Journaux de limite de débit" icon="clock-rotate-left" href="/fr/api-reference/endpoint/api_keys/rate_limit_logs?playground=open">
    Voir quelles requêtes ont atteint les limites
  </Card>
</CardGroup>

```bash theme={null}
curl https://api.venice.ai/api/v1/api_keys/rate_limits \
  -H "Authorization: Bearer $VENICE_API_KEY"
```

## Limites par défaut

### Modèles de texte et d'embedding

Les modèles de texte et d'embedding sont regroupés en quatre tailles. Chaque carte de modèle sur la [page Modèles](/fr/models/text) affiche son badge de taille. Tous les modèles d'embedding sont de taille XS.

| Taille | Requêtes/min | Tokens/min | Requêtes partenaire/min | Tokens partenaire/min |
| :----- | -----------: | ---------: | ----------------------: | --------------------: |
| XS     |          500 |  5 000 000 |                     500 |            10 000 000 |
| S      |          150 |  3 000 000 |                     300 |             6 000 000 |
| M      |          100 |  2 000 000 |                     200 |             4 000 000 |
| L      |          100 |  2 000 000 |                     150 |             3 000 000 |

<Note>
  Certains modèles fonctionnent sur une infrastructure dédiée ou tierce et sont soumis à des limites qui ne correspondent pas à ces quatre tailles. Appelez [`GET /api_keys/rate_limits`](/fr/api-reference/endpoint/api_keys/rate_limits) pour obtenir les limites par modèle faisant autorité pour votre clé.
</Note>

### Modèles d'image et d'audio

| Type                             | Requêtes/min | Requêtes partenaire/min |
| :------------------------------- | -----------: | ----------------------: |
| Image, upscale, inpaint          |           20 |                      60 |
| Synthèse vocale et transcription |           60 |                     120 |

### Modèles de vidéo et de musique

La génération de vidéo et de musique n'est pas soumise à une limite de débit. Toutes deux sont facturées par génération sur votre solde de crédits, si bien que la contrainte pratique est le coût plutôt qu'un plafond de requêtes. Estimez d'abord le prix d'une tâche avec [`POST /video/quote`](/fr/api-reference/endpoint/video/quote) ou [`POST /audio/quote`](/fr/api-reference/endpoint/audio/quote).

## Gestion des erreurs

Les requêtes échouées (500, 503, 429) doivent être relancées avec un backoff exponentiel.

Pour les erreurs 429 spécifiquement, consultez l'en-tête `x-ratelimit-reset-requests` pour l'horodatage Unix exact auquel vous pouvez réessayer. La plupart des bibliothèques HTTP disposent de mécanismes de relance intégrés qui gèrent cela automatiquement.

### Budgets d'erreurs

Deux limites supplémentaires protègent l'API contre les clients qui relancent leurs requêtes en boucle contre un mur. Toutes deux sont comptées par modèle et par clé API sur une fenêtre glissante de 30 secondes, et toutes deux renvoient `429` :

| Budget                                           |        Seuil | S'applique à                      |
| :----------------------------------------------- | -----------: | :-------------------------------- |
| Requêtes échouées                                |  50 par 30 s | Tous les endpoints                |
| Requêtes de fonctionnalités non prises en charge | 200 par 30 s | `/chat/completions`, `/responses` |

Le second budget compte les requêtes qui demandent à un modèle une fonctionnalité qu'il ne prend pas en charge, par exemple demander la vision ou l'appel d'outils à un modèle dépourvu de cette capacité. Le dépassement de l'un ou l'autre budget apparaît dans les [journaux de limite de débit](/fr/api-reference/endpoint/api_keys/rate_limit_logs) sous la forme `FAILED_REQUESTS` ou `UNSUPPORTED_FEATURE_REQUESTS`.

Les deux renvoient un `customMessage` indiquant le seuil qui a été déclenché :

```
Too many failed attempts (> 50) resulting in a non-success status code. Please wait 30 seconds and try again. See https://docs.venice.ai/api-reference/rate-limiting for more information.
```

Ces réponses définissent `x-ratelimit-remaining` et `x-ratelimit-resets` au lieu des en-têtes par fenêtre ci-dessous.

## En-têtes de réponse

Chaque réponse inclut ces en-têtes :

| En-tête                          | Description                                                    |
| :------------------------------- | :------------------------------------------------------------- |
| `x-ratelimit-limit-requests`     | Nombre maximum de requêtes autorisées dans la fenêtre actuelle |
| `x-ratelimit-remaining-requests` | Requêtes restantes dans la fenêtre actuelle                    |
| `x-ratelimit-reset-requests`     | Horodatage Unix de réinitialisation de la fenêtre              |
| `x-ratelimit-limit-tokens`       | Nombre maximum de tokens autorisés par minute                  |
| `x-ratelimit-remaining-tokens`   | Tokens restants dans la minute actuelle                        |
| `x-ratelimit-reset-tokens`       | Secondes avant la réinitialisation de la limite de tokens      |

L'endpoint `/crypto/rpc/{network}` utilise ses propres limites et ses propres en-têtes `X-RateLimit-Limit`, `X-RateLimit-Remaining` et `X-RateLimit-Reset`, qui ne sont définis que sur les réponses 429. Consultez [Crypto RPC](/fr/api-reference/endpoint/crypto/rpc) pour plus de détails.

## Niveau Partenaire

Les limites partenaire sont indiquées à côté des limites par défaut dans les tableaux ci-dessus.

Si vous atteignez constamment vos limites de débit et que vos modèles d'utilisation montrent une **demande soutenue dans le temps**, contactez-nous pour discuter de l'accès partenaire : [api@venice.ai](mailto:api@venice.ai).

Les limites du niveau partenaire peuvent être ajustées en fonction de vos besoins spécifiques.
