Aperçu
L’utilisation de l’API est soumise à des limites de débit. Ces limites restreignent les requêtes, les tokens ou d’autres utilisations pendant une période donnée.
Une réponse 429 peut indiquer une limite de débit temporaire, un solde prépayé épuisé ou une limite de dépenses ou d’utilisation. Vérifiez les détails de l’erreur avant de réessayer ou de modifier vos paramètres de facturation.
Déterminer la cause
Lisez le message d’erreur et error.code, le cas échéant. Les erreurs liées à la facturation peuvent tout de même utiliser la valeur error.type plus générale insufficient_quota.
| Erreur ou code | Signification | Mesure à prendre |
| Limite de débit atteinte pour les requêtes ou les tokens | Les requêtes dépassent une limite de débit applicable. | Espacez les requêtes et suivez les conseils ci-dessous pour réessayer. |
| credit_balance_exhausted | L’organisation n’a plus de crédits prépayés. | Ajoutez des crédits dans vos paramètres de facturation de l’API. |
| organization_usage_limit_exceeded | L’organisation a atteint la limite d’utilisation attribuée par OpenAI. | Demandez l’approbation d’une limite d’utilisation supérieure. |
| organization_spend_limit_exceeded | L’organisation a atteint sa limite de dépenses imposée. | Augmentez ou supprimez la limite, ou attendez la réinitialisation mensuelle. |
| project_spend_limit_exceeded | Le projet a atteint sa limite de dépenses imposée. | Augmentez ou supprimez la limite du projet, ou attendez la réinitialisation mensuelle. |
Réessayer après une erreur de facturation, de dépenses ou de quota ne rétablit pas l’accès. Corrigez d’abord le solde ou la limite signalés. L’application des modifications aux limites de dépenses imposées peut prendre du temps.
La modification d’une limite de dépenses exige l’autorisation de gérer les paramètres de l’organisation ou du projet concernés. Si vous n’y avez pas accès, demandez à la personne qui gère ces paramètres.
Pour l’achat de crédits prépayés, consultez : Configurer et gérer la facturation prépayée de l’API.
Pour connaître les différentes mesures de contrôle des dépenses, consultez le guide sur les limites de dépenses de l’API.
Vérifier les limites de débit applicables
Accédez à la page Limites de votre organisation pour consulter son niveau d’utilisation et ses limites actuels.
Les limites de débit peuvent s’appliquer aux niveaux de l’organisation et du projet. Il ne s’agit pas d’allocations individuelles par utilisateur. Les limites varient aussi selon le modèle, et certaines familles de modèles partagent une limite.
Vérifiez la limite indiquée par l’erreur. Par exemple, les requêtes par minute et les tokens par minute ont des limites distinctes. Vous pouvez atteindre l’une tout en restant sous l’autre.
Confirmer l’organisation utilisée par votre requête
Si vous appartenez à plusieurs organisations, confirmez que vos requêtes utilisent l’organisation et le projet prévus.
Lorsque votre clé API utilise une organisation par défaut, vérifiez votre paramètre d’organisation par défaut. Les organisations peuvent avoir des modalités de facturation et des niveaux d’utilisation différents.
Réduire les erreurs temporaires de limite de débit
Espacer les requêtes et éviter les rafales
Répartissez les requêtes dans le temps plutôt que d’en envoyer un grand nombre à la fois.
Les limites de débit peuvent être appliquées sur des périodes plus courtes que l’intervalle affiché. Par exemple, une limite de 60 requêtes par minute peut aussi être appliquée sur des périodes d’une seconde. Une courte rafale peut donc déclencher une erreur même si votre utilisation moyenne semble inférieure à la limite par minute.
Les longues invites et les allocations de tokens de sortie inutilement élevées peuvent aussi contribuer aux erreurs de débit de tokens.
Réessayer après un délai
Pour les erreurs temporaires de limite de débit :
Recherchez un en-tête de réponse Retry-After.
Si l’en-tête contient un délai valide, attendez au moins aussi longtemps avant de réessayer.
Si l’en-tête est absent ou non valide, utilisez un délai exponentiel avec gigue : augmentez le délai après chaque tentative infructueuse et ajoutez un court délai aléatoire.
Limitez le nombre de nouvelles tentatives et le temps total qui leur est consacré.
Les SDK officiels d’OpenAI réessaient déjà les erreurs de limite de débit admissibles et respectent Retry-After lorsqu’il est présent. Tenez compte de ces nouvelles tentatives avant d’ajouter une autre boucle de nouvelles tentatives.
Les requêtes infructueuses comptent dans les limites par minute. Renvoyer continuellement la même requête peut prolonger le problème.
Pour obtenir des conseils et des exemples de mise en œuvre, consultez le guide sur les limites de débit de l’API. Examinez toute bibliothèque tierce de nouvelles tentatives avant de l’utiliser dans votre application.
Examiner la taille de l’invite et de la sortie
Supprimez de vos invites les instructions inutiles, le contexte répété et les exemples. Testez l’invite révisée pour confirmer qu’elle produit toujours le résultat dont vous avez besoin.
Utilisez le paramètre de tokens de sortie pris en charge par votre point de terminaison et votre modèle :
Chat Completions utilise max_completion_tokens.
Responses utilise max_output_tokens.
Évitez de définir une allocation beaucoup plus élevée que nécessaire pour la requête. Ces paramètres comprennent les tokens de raisonnement ainsi que la sortie visible; tenez donc compte des deux lorsque vous utilisez un modèle de raisonnement.
Examiner votre niveau d’utilisation
Si les erreurs persistent après avoir réduit les rafales et examiné l’utilisation des tokens, consultez votre page Limites pour connaître les moyens disponibles d’augmenter vos limites.
À mesure que les dépenses liées à l’API augmentent, OpenAI peut automatiquement faire passer une organisation à un niveau d’utilisation supérieur. Cela augmente généralement les limites de débit pour la plupart des modèles.
Votre limite d’utilisation mensuelle approuvée est distincte des limites de débit des requêtes et des tokens. L’augmentation de l’une ne doit pas être considérée comme une confirmation que l’autre a changé.
Si le problème persiste
Avant de transmettre le problème
Gardez à portée de main le message d’erreur exact, tout code d’erreur, les ID de requête pertinents, l’heure de l’erreur avec votre fuseau horaire et la limite pertinente affichée dans votre compte. Notez les étapes que vous avez déjà essayées.
Communiquer avec l’assistance OpenAI
Communiquez avec l’assistance OpenAI par l’intermédiaire du centre d’assistance si vous ne parvenez pas à résoudre le problème après avoir vérifié la limite signalée. N’incluez pas de clés API ni d’autres secrets d’authentification.
