Oversigt
API-brug er underlagt brugsgrænser. Disse grænser begrænser antallet af anmodninger, tokens eller anden brug i en bestemt periode.
Et 429-svar kan angive en midlertidig brugsgrænse, en opbrugt forudbetalt saldo eller en forbrugs- eller brugsgrænse. Kontrollér fejloplysningerne, før du prøver igen eller ændrer dine faktureringsindstillinger.
Find årsagen
Læs fejlmeddelelsen og error.code, hvis den er angivet. Faktureringsrelaterede fejl kan stadig bruge den bredere error.type-værdi insufficient_quota.
| Fejl eller kode | Hvad det betyder | Hvad du skal gøre |
| Brugsgrænsen for anmodninger eller tokens er nået | Anmodningerne overskrider en gældende brugsgrænse. | Fordel anmodningerne over tid, og følg vejledningen om nye forsøg nedenfor. |
| credit_balance_exhausted | Organisationen har ingen forudbetalte kreditter tilbage. | Tilføj kreditter under dine indstillinger for API-fakturering. |
| organization_usage_limit_exceeded | Organisationen har nået den brugsgrænse, som OpenAI har tildelt. | Anmod om godkendelse af en højere brugsgrænse. |
| organization_spend_limit_exceeded | Organisationen har nået den håndhævede forbrugsgrænse. | Forhøj eller fjern grænsen, eller vent på den månedlige nulstilling. |
| project_spend_limit_exceeded | Projektet har nået den håndhævede forbrugsgrænse. | Forhøj eller fjern projektgrænsen, eller vent på den månedlige nulstilling. |
Nye forsøg efter en fakturerings-, forbrugs- eller kvotefejl genopretter ikke adgangen. Afhjælp først problemet med den angivne saldo eller grænse. Det kan tage tid, før ændringer af håndhævede forbrugsgrænser træder i kraft.
Ændring af en forbrugsgrænse kræver tilladelse til at administrere indstillingerne for den relevante organisation eller det relevante projekt. Hvis du ikke har adgang, skal du spørge den person, der administrerer disse indstillinger.
Læs mere om køb af forudbetalte kreditter her: Konfiguration og administration af forudbetalt API-fakturering.
Læs om de forskellige forbrugskontroller i vejledningen om API-forbrugsgrænser.
Kontrollér de gældende brugsgrænser
Gå til din organisations Grænser-side for at gennemgå dens aktuelle brugsniveau og grænser.
Brugsgrænser kan gælde på organisations- og projektniveau. De er ikke kvoter for individuelle brugere. Grænserne varierer også efter model, og visse modelfamilier deler en grænse.
Kontrollér, hvilken grænse fejlen angiver. Antallet af anmodninger pr. minut og tokens pr. minut har eksempelvis hver sin grænse. Du kan nå den ene, mens du stadig ligger under den anden.
Bekræft, hvilken organisation anmodningen bruger
Hvis du tilhører flere organisationer, skal du kontrollere, at dine anmodninger bruger den tilsigtede organisation og det tilsigtede projekt.
Hvis din API-nøgle bruger en standardorganisation, skal du kontrollere indstillingen for standardorganisation. Forskellige organisationer kan have forskellige faktureringsordninger og brugsniveauer.
Reducer midlertidige fejl vedrørende brugsgrænser
Fordel anmodningerne, og undgå pludselige stigninger
Fordel anmodningerne over tid i stedet for at sende mange på én gang.
Brugsgrænser kan håndhæves over kortere perioder end det viste interval. En grænse på 60 anmodninger pr. minut kan eksempelvis også håndhæves i perioder på ét sekund. En kortvarig stigning kan derfor udløse en fejl, selvom din gennemsnitlige brug ser ud til at ligge under grænsen pr. minut.
Lange prompts og unødigt høje grænser for outputtokens kan også bidrage til fejl vedrørende tokenbrugsgrænser.
Prøv igen efter en pause
Ved midlertidige fejl vedrørende brugsgrænser:
Se efter en Retry-After-header i svaret.
Hvis headeren indeholder en gyldig ventetid, skal du vente mindst så længe, før du prøver igen.
Hvis headeren mangler eller er ugyldig, skal du bruge eksponentiel backoff med jitter: Forlæng ventetiden efter hvert mislykket forsøg, og tilføj en kort, tilfældig ventetid.
Begræns både antallet af nye forsøg og den samlede tid, der bruges på dem.
Officielle OpenAI-SDK'er prøver allerede igen ved relevante fejl vedrørende brugsgrænser og respekterer Retry-After, når headeren er angivet. Tag højde for disse forsøg, før du tilføjer endnu en løkke til gentagne forsøg.
Mislykkede anmodninger tæller med i grænserne pr. minut. Hvis du hele tiden sender den samme anmodning igen, kan det forlænge problemet.
Du kan finde implementeringsvejledning og eksempler i vejledningen om API-brugsgrænser. Gennemgå tredjepartsbiblioteker til gentagne forsøg, før du bruger dem i din applikation.
Gennemgå prompt- og outputstørrelsen
Fjern unødvendige instruktioner, gentagen kontekst og eksempler fra dine prompts. Test den reviderede prompt for at sikre, at den stadig giver det ønskede resultat.
Brug den outputtokenparameter, som dit endepunkt og din model understøtter:
Chat Completions bruger max_completion_tokens.
Responses bruger max_output_tokens.
Undgå at angive en væsentligt højere grænse, end anmodningen kræver. Disse parametre omfatter både ræsonneringstokens og synligt output, så tag højde for begge dele, når du bruger en ræsonneringsmodel.
Gennemgå dit brugsniveau
Hvis fejlene fortsætter, efter du har reduceret pludselige stigninger og gennemgået tokenforbruget, kan du se mulighederne for at forhøje dine grænser på siden Grænser.
Når API-forbruget stiger, kan OpenAI automatisk flytte en organisation op på et højere brugsniveau. Det forhøjer normalt brugsgrænserne på tværs af de fleste modeller.
Din godkendte månedlige brugsgrænse er adskilt fra brugsgrænserne for anmodninger og tokens. En forhøjelse af den ene er ikke en bekræftelse på, at den anden er ændret.
Hvis problemet fortsætter
Før du eskalerer problemet
Hav den nøjagtige fejlmeddelelse, eventuelle fejlkoder, relevante anmodnings-id'er, tidspunktet for fejlen med din tidszone og den relevante grænse, der vises på din konto, ved hånden. Notér de trin, du allerede har prøvet.
Kontakt OpenAI Support
Kontakt OpenAI Support via Hjælp, hvis du ikke kan løse problemet efter at have kontrolleret den angivne grænse. Medtag ikke API-nøgler eller andre godkendelseshemmeligheder.
