Oversikt
API-bruk er underlagt bruksgrenser. Disse grensene begrenser antall forespørsler, tokener eller annen bruk i løpet av en angitt periode.
Et 429-svar kan indikere en midlertidig bruksgrense, oppbrukt forhåndsbetalt saldo eller en utgifts- eller forbruksgrense. Kontroller feildetaljene før du prøver på nytt eller endrer faktureringsinnstillingene.
Finn årsaken
Les feilmeldingen og error.code når denne er oppgitt. Faktureringsrelaterte feil kan fortsatt bruke den mer generelle error.type-verdien insufficient_quota.
| Feil eller kode | Hva det betyr | Hva du bør gjøre |
| Bruksgrensen for forespørsler eller tokener er nådd | Forespørslene overskrider en gjeldende bruksgrense. | Jevn ut forespørslene, og følg veiledningen nedenfor for nye forsøk. |
| credit_balance_exhausted | Organisasjonen har ingen forhåndsbetalte kreditter igjen. | Legg til kreditter i innstillingene for API-fakturering. |
| organization_usage_limit_exceeded | Organisasjonen har nådd forbruksgrensen som er tildelt av OpenAI. | Be om godkjenning av en høyere forbruksgrense. |
| organization_spend_limit_exceeded | Organisasjonen har nådd den håndhevede utgiftsgrensen. | Øk eller fjern grensen, eller vent til den månedlige tilbakestillingen. |
| project_spend_limit_exceeded | Prosjektet har nådd den håndhevede utgiftsgrensen. | Øk eller fjern prosjektgrensen, eller vent til den månedlige tilbakestillingen. |
Nye forsøk etter en fakturerings-, utgifts- eller kvotefeil gjenoppretter ikke tilgangen. Korriger først den rapporterte saldoen eller grensen. Det kan ta tid før endringer i håndhevede utgiftsgrenser trer i kraft.
Du må ha tillatelse til å administrere innstillingene for den aktuelle organisasjonen eller det aktuelle prosjektet for å endre en utgiftsgrense. Hvis du ikke har tilgang, kan du spørre personen som administrerer disse innstillingene.
Om kjøp av forhåndsbetalte kreditter: Konfigurer og administrer forhåndsbetalt API-fakturering.
Du finner informasjon om de ulike utgiftskontrollene i veiledningen om API-utgiftsgrenser.
Kontroller hvilke bruksgrenser som gjelder
Gå til organisasjonens Grenser-side for å se gjeldende bruksnivå og grenser.
Bruksgrenser kan gjelde på organisasjons- og prosjektnivå. De er ikke individuelle kvoter for hver bruker. Grensene varierer også etter modell, og enkelte modellfamilier deler en grense.
Kontroller hvilken grense feilen viser til. Forespørsler per minutt og tokener per minutt har for eksempel separate grenser. Du kan nå den ene mens du fortsatt ligger under den andre.
Bekreft hvilken organisasjon forespørselen bruker
Hvis du tilhører flere organisasjoner, må du bekrefte at forespørslene bruker riktig organisasjon og prosjekt.
Når API-nøkkelen bruker en standardorganisasjon, må du kontrollere innstillingen for standardorganisasjon. Ulike organisasjoner kan ha forskjellige faktureringsordninger og bruksnivåer.
Reduser midlertidige bruksgrensefeil
Jevn ut forespørslene og unngå topper
Fordel forespørslene over tid i stedet for å sende mange samtidig.
Bruksgrenser kan håndheves over kortere perioder enn det viste intervallet. En grense på 60 forespørsler per minutt kan for eksempel også håndheves i intervaller på ett sekund. En kortvarig topp kan derfor utløse en feil selv om gjennomsnittsbruken ser ut til å ligge under grensen per minutt.
Lange prompter og unødvendig høye grenser for utdatatokener kan også bidra til feil knyttet til tokengrenser.
Prøv på nytt etter en pause
Ved midlertidige feil knyttet til bruksgrenser:
Se etter svarhodet Retry-After.
Hvis svarhodet inneholder en gyldig ventetid, må du vente minst så lenge før du prøver på nytt.
Hvis svarhodet mangler eller er ugyldig, bruker du eksponentiell tilbakekobling med jitter: Øk ventetiden etter hvert mislykkede forsøk, og legg til en kort, tilfeldig forsinkelse.
Begrens både antall nye forsøk og den totale tiden som brukes på dem.
Offisielle SDK-er fra OpenAI prøver allerede kvalifiserte bruksgrensefeil på nytt og følger Retry-After når svarhodet finnes. Ta hensyn til disse forsøkene før du legger til en ny løkke for nye forsøk.
Mislykkede forespørsler teller med i grensene per minutt. Hvis du stadig sender den samme forespørselen på nytt, kan problemet vare lenger.
Du finner veiledning og eksempler på implementering i veiledningen om API-bruksgrenser. Vurder alle tredjepartsbiblioteker for nye forsøk før du bruker dem i applikasjonen.
Se gjennom størrelsen på prompt og utdata
Fjern unødvendige instruksjoner, gjentatt kontekst og eksempler fra promptene. Test den reviderte prompten for å bekrefte at den fortsatt gir ønsket resultat.
Bruk parameteren for utdatatokener som støttes av endepunktet og modellen:
Chat Completions bruker max_completion_tokens.
Responses bruker max_output_tokens.
Unngå å angi en mye høyere grense enn forespørselen trenger. Disse parameterne omfatter både resonneringstokener og synlige utdata. Ta derfor høyde for begge når du bruker en resonneringsmodell.
Se gjennom bruksnivået ditt
Hvis feilene fortsetter etter at du har redusert topper og gjennomgått tokenbruken, kan du se hvilke alternativer som finnes for å øke grensene på Grenser-siden.
Når API-forbruket øker, kan OpenAI automatisk flytte en organisasjon til et høyere bruksnivå. Dette øker vanligvis bruksgrensene for de fleste modeller.
Den godkjente månedlige forbruksgrensen er atskilt fra bruksgrensene for forespørsler og tokener. En økning av den ene må ikke tolkes som en bekreftelse på at den andre er endret.
Hvis problemet vedvarer
Før du eskalerer saken
Ha den nøyaktige feilmeldingen, eventuelle feilkoder, relevante forespørsels-ID-er, tidspunktet for feilen med tidssone og den aktuelle grensen som vises i kontoen, tilgjengelig. Noter hvilke trinn du allerede har prøvd.
Kontakt OpenAI-kundestøtte
Kontakt OpenAI-kundestøtte via hjelpesenteret hvis du ikke klarer å løse problemet etter å ha kontrollert den rapporterte grensen. Ikke oppgi API-nøkler eller andre autentiseringshemmeligheter.
