OpenAI
Den här sidan har maskinöversatts. Visa den ursprungliga engelska artikeln.

Felsöka API-frekvensgränser och 429-fel

Identifiera orsaken till ett API 429-fel, minska anhopningar av förfrågningar och välj rätt nästa steg för frekvens-, kredit- eller användningsgränser.

Uppdaterades: 14 days ago

Översikt

API-användning omfattas av frekvensgränser. Dessa gränser begränsar antalet förfrågningar, token eller annan användning under en angiven period.

Ett 429-svar kan tyda på en tillfällig frekvensgräns, ett förbrukat förskottsbetalt saldo eller en utgifts- eller användningsgräns. Kontrollera felinformationen innan du försöker igen eller ändrar faktureringsinställningarna.

Identifiera orsaken

Läs felmeddelandet och error.code, om den anges. Faktureringsrelaterade fel kan fortfarande använda det bredare error.type-värdet insufficient_quota.

Fel eller kodVad det innebärVad du ska göra
Frekvensgränsen för förfrågningar eller token har nåttsFörfrågningarna överskrider en tillämplig frekvensgräns.Fördela förfrågningarna och följ vägledningen om återförsök nedan.
credit_balance_exhaustedOrganisationen har inga förskottsbetalda krediter kvar.Lägg till krediter i inställningarna för API-fakturering.
organization_usage_limit_exceededOrganisationen har nått den användningsgräns som OpenAI har tilldelat den.Begär en högre godkänd användningsgräns.
organization_spend_limit_exceededOrganisationen har nått sin fastställda utgiftsgräns.Höj eller ta bort gränsen, eller vänta tills den återställs nästa månad.
project_spend_limit_exceededProjektet har nått sin fastställda utgiftsgräns.Höj eller ta bort projektgränsen, eller vänta tills den återställs nästa månad.

Att försöka igen efter ett fakturerings-, utgifts- eller kvotfel återställer inte åtkomsten. Åtgärda först det rapporterade saldot eller gränsen. Det kan ta tid innan ändringar av fastställda utgiftsgränser börjar gälla.

För att ändra en utgiftsgräns krävs behörighet att hantera inställningarna för den aktuella organisationen eller det aktuella projektet. Om du saknar åtkomst ber du den som hanterar inställningarna om hjälp.

Mer information om köp av förskottsbetalda krediter finns i Konfigurera och hantera förskottsbetald API-fakturering.

Information om de olika utgiftskontrollerna finns i guiden om API-utgiftsgränser.

Kontrollera tillämpliga frekvensgränser

Gå till organisationens Gränser-sida för att granska dess aktuella användningsnivå och gränser.

Frekvensgränser kan gälla på organisations- och projektnivå. De är inte individuella användarkvoter. Gränserna varierar också mellan modeller, och vissa modellfamiljer delar en gräns.

Kontrollera vilken gräns som anges i felet. Antalet förfrågningar per minut och antalet token per minut är exempelvis separata gränser. Du kan nå den ena samtidigt som du ligger under den andra.

Bekräfta vilken organisation förfrågan använder

Om du tillhör flera organisationer ska du kontrollera att förfrågningarna använder avsedd organisation och avsett projekt.

Om API-nyckeln använder en standardorganisation kontrollerar du inställningen för standardorganisation. Olika organisationer kan ha olika faktureringsupplägg och användningsnivåer.

Minska tillfälliga frekvensgränsfel

Fördela förfrågningarna och undvik anhopningar

Fördela förfrågningarna över tid i stället för att skicka många samtidigt.

Frekvensgränser kan tillämpas under kortare perioder än det intervall som visas. En gräns på 60 förfrågningar per minut kan exempelvis även tillämpas på perioder om en sekund. En kort anhopning kan därför utlösa ett fel även om den genomsnittliga användningen verkar ligga under minutgränsen.

Långa promptar och onödigt stora gränser för antal utdatatoken kan också bidra till tokenfrekvensfel.

Försök igen efter en fördröjning

Vid tillfälliga frekvensgränsfel:

  1. Kontrollera om svaret har ett Retry-After-huvud.

  2. Om huvudet innehåller en giltig fördröjning ska du vänta minst så länge innan du försöker igen.

  3. Om huvudet saknas eller är ogiltigt använder du exponentiell fördröjning med jitter: öka fördröjningen efter varje misslyckat försök och lägg till en kort slumpmässig fördröjning.

  4. Begränsa både antalet återförsök och den sammanlagda tiden för dem.

OpenAI:s officiella SDK:er försöker redan automatiskt igen vid berättigade frekvensgränsfel och följer Retry-After när det finns. Ta hänsyn till dessa återförsök innan du lägger till en ny återförsöksslinga.

Misslyckade förfrågningar räknas mot gränserna per minut. Att skicka samma förfrågan om och om igen kan förlänga problemet.

Vägledning och exempel finns i guiden om API-frekvensgränser. Granska externa bibliotek för återförsök innan du använder dem i din applikation.

Granska promptens och utdataresultatets storlek

Ta bort onödiga instruktioner, upprepad kontext och exempel från dina promptar. Testa den reviderade prompten för att bekräfta att den fortfarande ger det resultat du behöver.

Använd den parameter för utdatatoken som stöds av din slutpunkt och modell:

  • Chat Completions använder max_completion_tokens.

  • Responses använder max_output_tokens.

Undvik att ange en mycket högre gräns än vad förfrågan behöver. Dessa parametrar omfattar både resonemangstoken och synliga utdata, så ta hänsyn till båda när du använder en resonemangsmodell.

Granska din användningsnivå

Om felen kvarstår efter att du har minskat anhopningarna och granskat tokenanvändningen kan du se tillgängliga sätt att höja gränserna på sidan Gränser.

När API-utgifterna ökar kan OpenAI automatiskt flytta upp en organisation till en högre användningsnivå. Detta höjer vanligtvis frekvensgränserna för de flesta modeller.

Din godkända månatliga användningsgräns är separat från frekvensgränserna för förfrågningar och token. Att den ena höjs ska inte ses som en bekräftelse på att den andra har ändrats.

Om problemet kvarstår

Innan du eskalerar problemet

Ha det exakta felmeddelandet, eventuella felkoder, relevanta förfrågnings-ID:n, tidpunkten för felet inklusive tidszon samt den relevanta gränsen som visas i kontot till hands. Anteckna vilka steg du redan har provat.

Kontakta OpenAI Support

Kontakta OpenAI Support via Hjälpcenter om du inte kan lösa problemet efter att ha kontrollerat den rapporterade gränsen. Ta inte med API-nycklar eller andra autentiseringshemligheter.

Var den här artikeln till hjälp?