Présentation
L’utilisation de l’API est soumise à des limites de débit. Ces limites restreignent les requêtes, les tokens ou d’autres usages sur une période donnée.
Une réponse 429 peut indiquer une limite de débit temporaire, un solde prépayé épuisé ou une limite de dépenses ou d’utilisation. Vérifiez les détails de l’erreur avant de réessayer ou de modifier vos paramètres de facturation.
Identifier la cause
Lisez le message d’erreur et error.code, lorsqu’il est fourni. Les erreurs liées à la facturation peuvent toujours utiliser la valeur plus générale insufficient_quota pour error.type.
| Erreur ou code | Signification | Marche à suivre |
| Limite de débit atteinte pour les requêtes ou les tokens | Les requêtes dépassent une limite de débit applicable. | Espacez les requêtes et suivez les conseils de nouvelle tentative ci-dessous. |
| credit_balance_exhausted | L’organisation n’a plus de crédits prépayés. | Ajoutez des crédits dans les paramètres de facturation de votre API. |
| organization_usage_limit_exceeded | L’organisation a atteint la limite d’utilisation attribuée par OpenAI. | Demandez l’approbation d’une limite d’utilisation plus élevée. |
| organization_spend_limit_exceeded | L’organisation a atteint sa limite de dépenses appliquée. | Augmentez ou supprimez la limite, ou attendez sa réinitialisation mensuelle. |
| project_spend_limit_exceeded | Le projet a atteint sa limite de dépenses appliquée. | Augmentez ou supprimez la limite du projet, ou attendez sa réinitialisation mensuelle. |
Réessayer après une erreur de facturation, de dépenses ou de quota ne rétablit pas l’accès. Corrigez d’abord le problème de solde ou de limite signalé. L’application des modifications apportées aux limites de dépenses peut prendre du temps.
La modification d’une limite de dépenses nécessite l’autorisation de gérer les paramètres de l’organisation ou du projet concerné. Si vous n’y avez pas accès, adressez-vous à la personne qui gère ces paramètres.
Pour l’achat de crédits prépayés, consultez : Configurer et gérer la facturation prépayée de l’API.
Pour en savoir plus sur les différents contrôles des dépenses, consultez le guide des limites de dépenses de l’API.
Vérifier les limites de débit applicables
Accédez à la page Limites de votre organisation pour consulter son niveau d’utilisation et ses limites actuels.
Les limites de débit peuvent s’appliquer au niveau de l’organisation et du projet. Il ne s’agit pas de quotas individuels par utilisateur. Les limites varient aussi selon le modèle, et certaines familles de modèles partagent une même limite.
Vérifiez la limite indiquée par l’erreur. Par exemple, les requêtes par minute et les tokens par minute ont des limites distinctes. Vous pouvez atteindre l’une tout en restant sous l’autre.
Confirmer l’organisation utilisée par votre requête
Si vous appartenez à plusieurs organisations, vérifiez que vos requêtes utilisent l’organisation et le projet prévus.
Lorsque votre clé API utilise une organisation par défaut, vérifiez votre paramètre d’organisation par défaut. Les organisations peuvent avoir des modalités de facturation et des niveaux d’utilisation différents.
Réduire les erreurs temporaires de limite de débit
Espacer les requêtes et éviter les rafales
Répartissez les requêtes dans le temps au lieu d’en envoyer un grand nombre à la fois.
Les limites de débit peuvent être appliquées sur des périodes plus courtes que l’intervalle affiché. Par exemple, une limite de 60 requêtes par minute peut aussi être appliquée sur des périodes d’une seconde. Une courte rafale peut donc déclencher une erreur même si votre utilisation moyenne semble inférieure à la limite par minute.
Les prompts longs et les limites de tokens de sortie inutilement élevées peuvent aussi contribuer aux erreurs de débit de tokens.
Réessayer après un délai
Pour les erreurs temporaires de limite de débit :
Recherchez l’en-tête de réponse Retry-After.
Si l’en-tête contient un délai valide, attendez au moins aussi longtemps avant de réessayer.
Si l’en-tête est absent ou non valide, utilisez une temporisation exponentielle avec gigue : augmentez le délai après chaque tentative infructueuse et ajoutez un court délai aléatoire.
Limitez à la fois le nombre de nouvelles tentatives et leur durée totale.
Les SDK OpenAI officiels réessaient déjà les erreurs de limite de débit admissibles et respectent Retry-After lorsqu’il est présent. Tenez compte de ces nouvelles tentatives avant d’ajouter une autre boucle de nouvelle tentative.
Les requêtes infructueuses sont comptabilisées dans les limites par minute. Renvoyer continuellement la même requête peut prolonger le problème.
Pour obtenir des conseils et des exemples d’implémentation, consultez le guide des limites de débit de l’API. Examinez toute bibliothèque tierce de nouvelle tentative avant de l’utiliser dans votre application.
Vérifier la taille du prompt et de la sortie
Supprimez de vos prompts les instructions inutiles, les éléments de contexte répétés et les exemples. Testez le prompt révisé pour vérifier qu’il produit toujours le résultat souhaité.
Utilisez le paramètre de tokens de sortie pris en charge par votre point de terminaison et votre modèle :
Chat Completions utilise max_completion_tokens.
Responses utilise max_output_tokens.
Évitez de définir une limite bien supérieure aux besoins de la requête. Ces paramètres incluent les tokens de raisonnement ainsi que la sortie visible ; prévoyez donc les deux lorsque vous utilisez un modèle de raisonnement.
Vérifier votre niveau d’utilisation
Si les erreurs persistent après avoir réduit les rafales et vérifié l’utilisation des tokens, consultez la page Limites pour connaître les moyens disponibles d’augmenter vos limites.
À mesure que les dépenses liées à l’API augmentent, OpenAI peut automatiquement faire passer une organisation à un niveau d’utilisation supérieur. Cela augmente généralement les limites de débit pour la plupart des modèles.
Votre limite d’utilisation mensuelle approuvée est distincte des limites de débit des requêtes et des tokens. L’augmentation de l’une ne doit pas être considérée comme la confirmation que l’autre a changé.
Si le problème persiste
Avant de faire remonter le problème
Gardez à disposition le message d’erreur exact, tout code d’erreur, les ID de requête pertinents, l’heure de l’erreur avec votre fuseau horaire et la limite concernée affichée dans votre compte. Notez les étapes que vous avez déjà essayées.
Contacter l’assistance OpenAI
Contactez l’assistance OpenAI via le centre d’aide si vous ne parvenez pas à résoudre le problème après avoir vérifié la limite signalée. N’incluez pas de clés API ni d’autres secrets d’authentification.
