Översikt
API-användning omfattas av frekvensgränser. Dessa gränser begränsar antalet förfrågningar, token eller annan användning under en angiven period.
Ett 429-svar kan tyda på en tillfällig frekvensgräns, ett förbrukat förskottsbetalt saldo eller en utgifts- eller användningsgräns. Kontrollera felinformationen innan du försöker igen eller ändrar faktureringsinställningarna.
Identifiera orsaken
Läs felmeddelandet och error.code, om den anges. Faktureringsrelaterade fel kan fortfarande använda det bredare error.type-värdet insufficient_quota.
| Fel eller kod | Vad det innebär | Vad du ska göra |
| Frekvensgränsen för förfrågningar eller token har nåtts | Förfrågningarna överskrider en tillämplig frekvensgräns. | Fördela förfrågningarna och följ vägledningen om återförsök nedan. |
| credit_balance_exhausted | Organisationen har inga förskottsbetalda krediter kvar. | Lägg till krediter i inställningarna för API-fakturering. |
| organization_usage_limit_exceeded | Organisationen har nått den användningsgräns som OpenAI har tilldelat den. | Begär en högre godkänd användningsgräns. |
| organization_spend_limit_exceeded | Organisationen har nått sin fastställda utgiftsgräns. | Höj eller ta bort gränsen, eller vänta tills den återställs nästa månad. |
| project_spend_limit_exceeded | Projektet har nått sin fastställda utgiftsgräns. | Höj eller ta bort projektgränsen, eller vänta tills den återställs nästa månad. |
Att försöka igen efter ett fakturerings-, utgifts- eller kvotfel återställer inte åtkomsten. Åtgärda först det rapporterade saldot eller gränsen. Det kan ta tid innan ändringar av fastställda utgiftsgränser börjar gälla.
För att ändra en utgiftsgräns krävs behörighet att hantera inställningarna för den aktuella organisationen eller det aktuella projektet. Om du saknar åtkomst ber du den som hanterar inställningarna om hjälp.
Mer information om köp av förskottsbetalda krediter finns i Konfigurera och hantera förskottsbetald API-fakturering.
Information om de olika utgiftskontrollerna finns i guiden om API-utgiftsgränser.
Kontrollera tillämpliga frekvensgränser
Gå till organisationens Gränser-sida för att granska dess aktuella användningsnivå och gränser.
Frekvensgränser kan gälla på organisations- och projektnivå. De är inte individuella användarkvoter. Gränserna varierar också mellan modeller, och vissa modellfamiljer delar en gräns.
Kontrollera vilken gräns som anges i felet. Antalet förfrågningar per minut och antalet token per minut är exempelvis separata gränser. Du kan nå den ena samtidigt som du ligger under den andra.
Bekräfta vilken organisation förfrågan använder
Om du tillhör flera organisationer ska du kontrollera att förfrågningarna använder avsedd organisation och avsett projekt.
Om API-nyckeln använder en standardorganisation kontrollerar du inställningen för standardorganisation. Olika organisationer kan ha olika faktureringsupplägg och användningsnivåer.
Minska tillfälliga frekvensgränsfel
Fördela förfrågningarna och undvik anhopningar
Fördela förfrågningarna över tid i stället för att skicka många samtidigt.
Frekvensgränser kan tillämpas under kortare perioder än det intervall som visas. En gräns på 60 förfrågningar per minut kan exempelvis även tillämpas på perioder om en sekund. En kort anhopning kan därför utlösa ett fel även om den genomsnittliga användningen verkar ligga under minutgränsen.
Långa promptar och onödigt stora gränser för antal utdatatoken kan också bidra till tokenfrekvensfel.
Försök igen efter en fördröjning
Vid tillfälliga frekvensgränsfel:
Kontrollera om svaret har ett Retry-After-huvud.
Om huvudet innehåller en giltig fördröjning ska du vänta minst så länge innan du försöker igen.
Om huvudet saknas eller är ogiltigt använder du exponentiell fördröjning med jitter: öka fördröjningen efter varje misslyckat försök och lägg till en kort slumpmässig fördröjning.
Begränsa både antalet återförsök och den sammanlagda tiden för dem.
OpenAI:s officiella SDK:er försöker redan automatiskt igen vid berättigade frekvensgränsfel och följer Retry-After när det finns. Ta hänsyn till dessa återförsök innan du lägger till en ny återförsöksslinga.
Misslyckade förfrågningar räknas mot gränserna per minut. Att skicka samma förfrågan om och om igen kan förlänga problemet.
Vägledning och exempel finns i guiden om API-frekvensgränser. Granska externa bibliotek för återförsök innan du använder dem i din applikation.
Granska promptens och utdataresultatets storlek
Ta bort onödiga instruktioner, upprepad kontext och exempel från dina promptar. Testa den reviderade prompten för att bekräfta att den fortfarande ger det resultat du behöver.
Använd den parameter för utdatatoken som stöds av din slutpunkt och modell:
Chat Completions använder max_completion_tokens.
Responses använder max_output_tokens.
Undvik att ange en mycket högre gräns än vad förfrågan behöver. Dessa parametrar omfattar både resonemangstoken och synliga utdata, så ta hänsyn till båda när du använder en resonemangsmodell.
Granska din användningsnivå
Om felen kvarstår efter att du har minskat anhopningarna och granskat tokenanvändningen kan du se tillgängliga sätt att höja gränserna på sidan Gränser.
När API-utgifterna ökar kan OpenAI automatiskt flytta upp en organisation till en högre användningsnivå. Detta höjer vanligtvis frekvensgränserna för de flesta modeller.
Din godkända månatliga användningsgräns är separat från frekvensgränserna för förfrågningar och token. Att den ena höjs ska inte ses som en bekräftelse på att den andra har ändrats.
Om problemet kvarstår
Innan du eskalerar problemet
Ha det exakta felmeddelandet, eventuella felkoder, relevanta förfrågnings-ID:n, tidpunkten för felet inklusive tidszon samt den relevanta gränsen som visas i kontot till hands. Anteckna vilka steg du redan har provat.
Kontakta OpenAI Support
Kontakta OpenAI Support via Hjälpcenter om du inte kan lösa problemet efter att ha kontrollerat den rapporterade gränsen. Ta inte med API-nycklar eller andra autentiseringshemligheter.
