OpenAI
Diese Seite wurde maschinell übersetzt. Den Originalartikel auf Englisch ansehen.

Fehlerbehebung bei API-Ratenlimits und 429-Fehlern

Ermittle die Ursache eines API-429-Fehlers, reduziere Anfragespitzen und wähle den richtigen nächsten Schritt bei Raten-, Credit- oder Nutzungslimits.

Aktualisiert: 17 days ago

Überblick

Für die API-Nutzung gelten Ratenlimits. Diese Limits begrenzen Anfragen, Tokens oder eine andere Nutzung innerhalb eines bestimmten Zeitraums.

Eine 429-Antwort kann auf ein vorübergehendes Ratenlimit, ein aufgebrauchtes Prepaid-Guthaben oder ein Ausgaben- beziehungsweise Nutzungslimit hinweisen. Prüfe die Fehlerdetails, bevor du es erneut versuchst oder deine Abrechnungseinstellungen änderst.

Ursache ermitteln

Lies die Fehlermeldung und, sofern angegeben, error.code. Bei abrechnungsbezogenen Fehlern kann der allgemeinere Wert insufficient_quota für error.type verwendet werden.

Fehler oder CodeBedeutungVorgehensweise
Ratenlimit für Anfragen oder Tokens erreichtDie Anfragen überschreiten ein geltendes Ratenlimit.Verteile die Anfragen und befolge die nachfolgenden Hinweise zu Wiederholungsversuchen.
credit_balance_exhaustedDie Organisation hat keine Prepaid-Credits mehr.Füge in deinen API-Abrechnungseinstellungen Credits hinzu.
organization_usage_limit_exceededDie Organisation hat ihr von OpenAI festgelegtes Nutzungslimit erreicht.Beantrage ein höheres genehmigtes Nutzungslimit.
organization_spend_limit_exceededDie Organisation hat ihr verbindlich angewandtes Ausgabenlimit erreicht.Erhöhe oder entferne das Limit oder warte auf die monatliche Zurücksetzung.
project_spend_limit_exceededDas Projekt hat sein verbindlich angewandtes Ausgabenlimit erreicht.Erhöhe oder entferne das Projektlimit oder warte auf die monatliche Zurücksetzung.

Ein erneuter Versuch stellt den Zugriff bei einem Abrechnungs-, Ausgaben- oder Kontingentfehler nicht wieder her. Kläre zuerst das gemeldete Guthaben oder Limit. Es kann einige Zeit dauern, bis Änderungen an verbindlich angewandten Ausgabenlimits wirksam werden.

Zum Ändern eines Ausgabenlimits brauchst du die Berechtigung, die entsprechenden Organisations- oder Projekteinstellungen zu verwalten. Wenn du keinen Zugriff hast, wende dich an die Person, die diese Einstellungen verwaltet.

Informationen zum Kauf von Prepaid-Credits findest du unter Prepaid-Abrechnung für die API einrichten und verwalten.

Informationen zu den verschiedenen Ausgabenkontrollen findest du im Leitfaden zu API-Ausgabenlimits.

Geltende Ratenlimits prüfen

Öffne die Seite Limits deiner Organisation, um ihre aktuelle Nutzungsstufe und ihre Limits zu prüfen.

Ratenlimits können auf Organisations- und Projektebene gelten. Es handelt sich nicht um individuelle Kontingente einzelner Personen. Die Limits unterscheiden sich außerdem je nach Modell. Einige Modellfamilien teilen sich ein Limit.

Prüfe, welches Limit im Fehler genannt wird. Anfragen pro Minute und Tokens pro Minute sind beispielsweise separate Limits. Du kannst eines davon erreichen und zugleich unter dem anderen bleiben.

Von der Anfrage verwendete Organisation bestätigen

Wenn du mehreren Organisationen angehörst, vergewissere dich, dass deine Anfragen die vorgesehene Organisation und das vorgesehene Projekt verwenden.

Wenn dein API-Schlüssel eine Standardorganisation verwendet, prüfe deine Einstellung für die Standardorganisation. Für verschiedene Organisationen können unterschiedliche Abrechnungsmodelle und Nutzungsstufen gelten.

Vorübergehende Ratenlimitfehler reduzieren

Anfragen verteilen und Spitzen vermeiden

Verteile Anfragen über einen längeren Zeitraum, statt viele gleichzeitig zu senden.

Ratenlimits können über kürzere Zeiträume als das angezeigte Intervall durchgesetzt werden. Ein Limit von 60 Anfragen pro Minute kann beispielsweise auch über Zeiträume von einer Sekunde durchgesetzt werden. Eine kurze Anfragespitze kann daher einen Fehler auslösen, auch wenn deine durchschnittliche Nutzung unter dem Minutenlimit zu liegen scheint.

Lange Prompts und unnötig hohe Kontingente für Ausgabe-Tokens können ebenfalls zu Token-Ratenfehlern beitragen.

Nach einer Wartezeit erneut versuchen

Bei vorübergehenden Ratenlimitfehlern:

  1. Prüfe, ob die Antwort den Header Retry-After enthält.

  2. Wenn der Header eine gültige Wartezeit enthält, warte mindestens so lange, bevor du es erneut versuchst.

  3. Fehlt der Header oder ist er ungültig, verwende exponentielles Backoff mit Jitter: Verlängere die Wartezeit nach jedem fehlgeschlagenen Versuch und füge eine kurze zufällige Verzögerung hinzu.

  4. Begrenze sowohl die Anzahl der Wiederholungsversuche als auch deren Gesamtdauer.

Offizielle SDKs von OpenAI wiederholen geeignete Ratenlimitfehler bereits und berücksichtigen Retry-After, wenn der Header vorhanden ist. Berücksichtige diese Wiederholungsversuche, bevor du eine weitere Wiederholungsschleife hinzufügst.

Fehlgeschlagene Anfragen werden auf die Minutenlimits angerechnet. Wenn du dieselbe Anfrage fortlaufend erneut sendest, kann das Problem länger bestehen bleiben.

Hinweise und Beispiele zur Implementierung findest du im Leitfaden zu API-Ratenlimits. Prüfe jede Wiederholungsbibliothek eines Drittanbieters, bevor du sie in deiner Anwendung verwendest.

Größe von Prompt und Ausgabe prüfen

Entferne unnötige Anweisungen, wiederholten Kontext und Beispiele aus deinen Prompts. Teste den überarbeiteten Prompt, um sicherzustellen, dass er weiterhin das benötigte Ergebnis liefert.

Verwende den von deinem Endpunkt und Modell unterstützten Parameter für Ausgabe-Tokens:

  • Chat Completions verwendet max_completion_tokens.

  • Responses verwendet max_output_tokens.

Lege kein wesentlich größeres Kontingent fest, als die Anfrage benötigt. Diese Parameter umfassen sowohl Reasoning-Tokens als auch die sichtbare Ausgabe. Berücksichtige bei einem Reasoning-Modell daher beides.

Nutzungsstufe prüfen

Wenn die Fehler nach dem Reduzieren von Anfragespitzen und dem Prüfen der Token-Nutzung weiterhin auftreten, sieh auf der Seite Limits nach, wie du deine Limits erhöhen kannst.

Mit steigenden API-Ausgaben kann OpenAI eine Organisation automatisch einer höheren Nutzungsstufe zuordnen. Dadurch steigen in der Regel die Ratenlimits für die meisten Modelle.

Dein genehmigtes monatliches Nutzungslimit ist von den Ratenlimits für Anfragen und Tokens getrennt. Wenn sich eines erhöht, ist damit nicht bestätigt, dass sich auch das andere geändert hat.

Wenn das Problem weiterhin besteht

Vor der Eskalation

Halte die genaue Fehlermeldung, alle Fehlercodes, relevanten Anfrage-IDs, den Zeitpunkt des Fehlers einschließlich deiner Zeitzone und das in deinem Konto angezeigte relevante Limit bereit. Notiere, welche Schritte du bereits ausprobiert hast.

OpenAI-Support kontaktieren

Kontaktiere den OpenAI-Support über das Hilfecenter, wenn du das Problem nach Prüfung des gemeldeten Limits nicht beheben kannst. Gib keine API-Schlüssel oder andere geheimen Authentifizierungsdaten an.

War dieser Artikel hilfreich?