OpenAI
Ta strona została przetłumaczona maszynowo. Wyświetl oryginalny artykuł w języku angielskim.

Rozwiązywanie problemów z limitami zapytań API i błędami 429

Ustal przyczynę błędu API 429, ogranicz nagłe wzrosty liczby zapytań i wybierz odpowiednie rozwiązanie problemu z limitem zapytań, środków lub użycia.

Zaktualizowano: yesterday

Przegląd

Korzystanie z API podlega limitom zapytań. Limity te ograniczają liczbę zapytań, tokenów lub inne wykorzystanie w określonym czasie.

Odpowiedź 429 może oznaczać tymczasowy limit zapytań, wyczerpanie przedpłaconego salda albo osiągnięcie limitu wydatków lub użycia. Przed ponowieniem próby lub zmianą ustawień rozliczeń sprawdź szczegóły błędu.

Ustal przyczynę

Przeczytaj komunikat o błędzie oraz wartość error.code, jeśli ją podano. Błędy związane z rozliczeniami mogą nadal używać ogólniejszej wartości error.type: insufficient_quota.

Błąd lub kodCo to oznaczaCo zrobić
Osiągnięto limit zapytań lub tokenówZapytania przekraczają obowiązujący limit zapytań.Rozłóż zapytania w czasie i postępuj zgodnie z poniższymi wskazówkami dotyczącymi ponawiania prób.
credit_balance_exhaustedOrganizacja nie ma już przedpłaconych środków.Dodaj środki w ustawieniach rozliczeń API.
organization_usage_limit_exceededOrganizacja osiągnęła limit użycia przydzielony przez OpenAI.Poproś o zatwierdzenie wyższego limitu użycia.
organization_spend_limit_exceededOrganizacja osiągnęła egzekwowany limit wydatków.Zwiększ lub usuń limit albo poczekaj na jego comiesięczne wyzerowanie.
project_spend_limit_exceededProjekt osiągnął egzekwowany limit wydatków.Zwiększ lub usuń limit projektu albo poczekaj na jego comiesięczne wyzerowanie.

Ponawianie próby po błędzie rozliczeń, wydatków lub limitu nie przywróci dostępu. Najpierw rozwiąż zgłoszony problem z saldem lub limitem. Zastosowanie zmian egzekwowanych limitów wydatków może potrwać.

Zmiana limitu wydatków wymaga uprawnień do zarządzania ustawieniami odpowiedniej organizacji lub projektu. Jeśli nie masz dostępu, poproś o pomoc osobę zarządzającą tymi ustawieniami.

Informacje o zakupie przedpłaconych środków znajdziesz tutaj: Konfigurowanie przedpłaconych rozliczeń API i zarządzanie nimi.

Informacje o różnych mechanizmach kontroli wydatków znajdziesz w przewodniku po limitach wydatków API.

Sprawdź obowiązujące limity zapytań

Przejdź na stronę Limity swojej organizacji, aby sprawdzić jej aktualny poziom użycia i limity.

Limity zapytań mogą obowiązywać na poziomie organizacji i projektu. Nie są to limity przydzielane poszczególnym użytkownikom. Limity różnią się również zależnie od modelu, a niektóre rodziny modeli współdzielą limit.

Sprawdź, który limit wskazuje błąd. Na przykład liczba zapytań na minutę i liczba tokenów na minutę mają osobne limity. Możesz osiągnąć jeden z nich, pozostając poniżej drugiego.

Potwierdź organizację używaną przez zapytanie

Jeśli należysz do wielu organizacji, upewnij się, że zapytania korzystają z właściwej organizacji i projektu.

Jeśli klucz API korzysta z organizacji domyślnej, sprawdź ustawienie organizacji domyślnej. Poszczególne organizacje mogą mieć różne zasady rozliczeń i poziomy użycia.

Ogranicz tymczasowe błędy limitu zapytań

Rozłóż zapytania w czasie i unikaj nagłych wzrostów

Rozłóż zapytania w czasie, zamiast wysyłać dużą ich liczbę naraz.

Limity zapytań mogą być egzekwowane w okresach krótszych niż wyświetlany przedział. Na przykład limit 60 zapytań na minutę może być również egzekwowany w okresach jednosekundowych. Dlatego krótkotrwały wzrost liczby zapytań może wywołać błąd, nawet jeśli średnie użycie jest niższe od limitu minutowego.

Długie polecenia oraz niepotrzebnie wysokie limity tokenów wyjściowych również mogą powodować błędy limitu tokenów.

Ponów próbę po odczekaniu

W przypadku tymczasowych błędów limitu zapytań:

  1. Sprawdź, czy odpowiedź zawiera nagłówek Retry-After.

  2. Jeśli nagłówek zawiera prawidłowy czas oczekiwania, odczekaj co najmniej tyle przed ponowieniem próby.

  3. Jeśli nagłówka brakuje lub jest nieprawidłowy, zastosuj wykładnicze wydłużanie czasu oczekiwania z losowym odchyleniem: zwiększaj opóźnienie po każdej nieudanej próbie i dodawaj niewielkie losowe opóźnienie.

  4. Ogranicz zarówno liczbę ponownych prób, jak i łączny czas przeznaczony na ich wykonywanie.

Oficjalne zestawy SDK OpenAI automatycznie ponawiają zapytania w przypadku odpowiednich błędów limitu zapytań i respektują nagłówek Retry-After, gdy jest dostępny. Uwzględnij te próby przed dodaniem kolejnej pętli ponawiania.

Nieudane zapytania wliczają się do limitów minutowych. Ciągłe ponawianie tego samego zapytania może przedłużyć problem.

Wskazówki dotyczące implementacji i przykłady znajdziesz w przewodniku po limitach zapytań API. Przed użyciem w aplikacji sprawdź każdą zewnętrzną bibliotekę do ponawiania prób.

Sprawdź rozmiar polecenia i danych wyjściowych

Usuń z poleceń zbędne instrukcje, powtarzający się kontekst i przykłady. Przetestuj zmienione polecenie, aby upewnić się, że nadal daje oczekiwany wynik.

Użyj parametru tokenów wyjściowych obsługiwanego przez punkt końcowy i model:

  • Chat Completions używa parametru max_completion_tokens.

  • Responses używa parametru max_output_tokens.

Nie ustawiaj limitu znacznie wyższego niż potrzebny do obsługi zapytania. Parametry te obejmują zarówno tokeny rozumowania, jak i widoczne dane wyjściowe, dlatego podczas korzystania z modelu rozumującego uwzględnij oba rodzaje.

Sprawdź swój poziom użycia

Jeśli po ograniczeniu nagłych wzrostów liczby zapytań i sprawdzeniu użycia tokenów błędy nadal występują, sprawdź na stronie Limity dostępne sposoby zwiększenia limitów.

Wraz ze wzrostem wydatków na API OpenAI może automatycznie przenieść organizację na wyższy poziom użycia. Zwykle zwiększa to limity zapytań dla większości modeli.

Zatwierdzony miesięczny limit użycia jest niezależny od limitów liczby zapytań i tokenów. Zwiększenie jednego z nich nie oznacza, że drugi również się zmienił.

Jeśli problem nadal występuje

Przed eskalacją problemu

Przygotuj dokładny komunikat o błędzie, ewentualny kod błędu, odpowiednie identyfikatory zapytań, czas wystąpienia błędu wraz ze strefą czasową oraz właściwy limit widoczny na koncie. Zanotuj podjęte już działania.

Skontaktuj się z pomocą techniczną OpenAI

Jeśli po sprawdzeniu wskazanego limitu nie uda się rozwiązać problemu, skontaktuj się z pomocą techniczną OpenAI przez Centrum pomocy. Nie podawaj kluczy API ani innych poufnych danych uwierzytelniających.

Czy ten artykuł był pomocny?