Přehled
Na využívání API se vztahují limity frekvence požadavků. Tyto limity omezují počet požadavků, tokenů nebo jiné využití za stanovené období.
Odpověď 429 může signalizovat dočasné překročení limitu frekvence požadavků, vyčerpání předplaceného zůstatku nebo překročení limitu útraty či využití. Než požadavek zopakujete nebo změníte nastavení fakturace, zkontrolujte podrobnosti chyby.
Zjistěte příčinu
Přečtěte si chybovou zprávu a případně uvedenou hodnotu error.code. Chyby související s fakturací mohou i nadále používat obecnější hodnotu error.type insufficient_quota.
| Chyba nebo kód | Co to znamená | Co dělat |
| Dosažen limit frekvence požadavků nebo tokenů | Požadavky překračují příslušný limit frekvence požadavků. | Rozložte požadavky v čase a postupujte podle níže uvedených pokynů k jejich opakování. |
| credit_balance_exhausted | Organizace již nemá žádné předplacené kredity. | Přidejte kredity v nastavení fakturace API. |
| organization_usage_limit_exceeded | Organizace dosáhla limitu využití přiděleného společností OpenAI. | Požádejte o schválení vyššího limitu využití. |
| organization_spend_limit_exceeded | Organizace dosáhla vynuceného limitu útraty. | Zvyšte nebo odstraňte limit, případně počkejte na jeho měsíční obnovení. |
| project_spend_limit_exceeded | Projekt dosáhl vynuceného limitu útraty. | Zvyšte nebo odstraňte limit projektu, případně počkejte na jeho měsíční obnovení. |
Opakování požadavku při chybě fakturace, útraty nebo kvóty přístup neobnoví. Nejprve vyřešte uvedený zůstatek nebo limit. Uplatnění změn vynucených limitů útraty může nějakou dobu trvat.
Ke změně limitu útraty potřebujete oprávnění spravovat nastavení příslušné organizace nebo projektu. Pokud přístup nemáte, požádejte osobu, která tato nastavení spravuje.
Informace o nákupu předplacených kreditů najdete v článku Nastavení a správa předplacené fakturace API.
Informace o různých způsobech řízení útraty najdete v průvodci limity útraty za API.
Kontrola příslušných limitů frekvence požadavků
Aktuální úroveň využití a limity organizace najdete na její stránce Limity.
Limity frekvence požadavků se mohou uplatňovat na úrovni organizace i projektu. Nejde o limity přidělené jednotlivým uživatelům. Limity se liší také podle modelu a některé rodiny modelů sdílejí společný limit.
Zkontrolujte, který limit je v chybě uveden. Například počet požadavků za minutu a počet tokenů za minutu jsou dva samostatné limity. Jednoho můžete dosáhnout, i když druhý nepřekračujete.
Ověřte organizaci použitou v požadavku
Pokud patříte do více organizací, ověřte, že požadavky používají zamýšlenou organizaci a projekt.
Pokud váš klíč API používá výchozí organizaci, zkontrolujte nastavení výchozí organizace. Různé organizace mohou mít odlišné způsoby fakturace a úrovně využití.
Omezení dočasných chyb limitu frekvence požadavků
Rozložte požadavky v čase a vyhněte se nárazovým špičkám
Namísto odeslání velkého počtu požadavků najednou je rozložte v čase.
Limity frekvence požadavků mohou být vynucovány v kratších úsecích, než je zobrazený interval. Například limit 60 požadavků za minutu může být zároveň vynucován v jednosekundových intervalech. Krátká nárazová špička proto může vyvolat chybu, i když se vaše průměrné využití zdá být pod minutovým limitem.
K chybám limitu frekvence tokenů mohou přispívat také dlouhé prompty a zbytečně vysoké limity výstupních tokenů.
Opakujte požadavek s prodlevou
Při dočasných chybách limitu frekvence požadavků:
Zkontrolujte, zda odpověď obsahuje hlavičku Retry-After.
Pokud hlavička obsahuje platnou prodlevu, počkejte před opakováním požadavku alespoň uvedenou dobu.
Pokud hlavička chybí nebo je neplatná, použijte exponenciální prodlevu s náhodným rozptylem: po každém neúspěšném pokusu prodlevu prodlužte a přidejte krátké náhodné zpoždění.
Omezte počet opakování i celkovou dobu věnovanou opakovaným pokusům.
Oficiální sady SDK OpenAI již automaticky opakují požadavky u příslušných chyb limitu frekvence požadavků a respektují hlavičku Retry-After, pokud je uvedena. Než přidáte další smyčku opakování, zohledněte tyto automatické pokusy.
Do minutových limitů se započítávají i neúspěšné požadavky. Neustálé opakování stejného požadavku může problém prodloužit.
Pokyny k implementaci a příklady najdete v průvodci limity frekvence požadavků API. Než ve své aplikaci použijete knihovnu třetí strany pro opakování požadavků, prověřte ji.
Kontrola velikosti promptu a výstupu
Odstraňte z promptů zbytečné pokyny, opakující se kontext a příklady. Upravený prompt otestujte a ověřte, že stále vytváří požadovaný výsledek.
Použijte parametr výstupních tokenů podporovaný vaším koncovým bodem a modelem:
Chat Completions používá max_completion_tokens.
Responses používá max_output_tokens.
Nenastavujte výrazně vyšší limit, než požadavek potřebuje. Tyto parametry zahrnují tokeny uvažování i viditelný výstup. Při použití modelu s uvažováním proto počítejte s obojím.
Kontrola úrovně využití
Pokud chyby přetrvávají i po omezení nárazových špiček a kontrole využití tokenů, podívejte se na stránku Limity, jakými způsoby lze limity zvýšit.
S rostoucí útratou za API může OpenAI organizaci automaticky převést na vyšší úroveň využití. Tím se obvykle zvýší limity frekvence požadavků u většiny modelů.
Schválený měsíční limit využití je nezávislý na limitech frekvence požadavků a tokenů. Zvýšení jednoho nepotvrzuje, že se změnil i druhý.
Pokud problém přetrvává
Než problém předáte podpoře
Připravte si přesné znění chybové zprávy, případný kód chyby, příslušná ID požadavků, čas výskytu chyby včetně časového pásma a příslušný limit zobrazený ve vašem účtu. Poznamenejte si kroky, které jste již vyzkoušeli.
Kontaktování podpory OpenAI
Pokud problém nevyřešíte ani po kontrole uvedeného limitu, obraťte se na podporu OpenAI prostřednictvím Centra nápovědy. Neuvádějte klíče API ani jiné tajné ověřovací údaje.
