OpenAI
Această pagină a fost tradusă automat. Vezi articolul original în limba engleză.

Depanarea limitelor de rată API și a erorilor 429

Identifică motivul unei erori API 429, redu rafalele de solicitări și alege pasul următor potrivit pentru limitele de rată, credite sau utilizare.

Actualizat: 16 days ago

Prezentare generală

Utilizarea API-ului este supusă limitelor de rată. Aceste limite restricționează solicitările, tokenurile sau alte tipuri de utilizare într-o anumită perioadă.

Un răspuns 429 poate indica o limită de rată temporară, epuizarea soldului preplătit sau o limită de cheltuieli ori de utilizare. Verifică detaliile erorii înainte de a reîncerca sau de a modifica setările de facturare.

Identifică motivul

Citește mesajul de eroare și error.code, dacă este furnizat. Erorile legate de facturare pot folosi în continuare valoarea mai generală insufficient_quota pentru error.type.

Eroare sau codCe înseamnăCe trebuie să faci
A fost atinsă limita de rată pentru solicitări sau tokenuriSolicitările depășesc o limită de rată aplicabilă.Distribuie solicitările în timp și urmează instrucțiunile de reîncercare de mai jos.
credit_balance_exhaustedOrganizația nu mai are credite preplătite.Adaugă credite în setările de facturare API.
organization_usage_limit_exceededOrganizația a atins limita de utilizare atribuită de OpenAI.Solicită aprobarea unei limite de utilizare mai mari.
organization_spend_limit_exceededOrganizația a atins limita de cheltuieli impusă.Mărește sau elimină limita ori așteaptă resetarea lunară.
project_spend_limit_exceededProiectul a atins limita de cheltuieli impusă.Mărește sau elimină limita proiectului ori așteaptă resetarea lunară.

Reîncercarea după o eroare de facturare, cheltuieli sau cotă nu restabilește accesul. Rezolvă mai întâi problema raportată privind soldul sau limita. Aplicarea modificărilor aduse limitelor de cheltuieli impuse poate dura.

Modificarea unei limite de cheltuieli necesită permisiunea de a gestiona setările organizației sau proiectului relevant. Dacă nu ai acces, contactează persoana care gestionează setările respective.

Pentru achiziționarea creditelor preplătite, consultă: Configurarea și gestionarea facturării API preplătite.

Pentru diferitele mecanisme de control al cheltuielilor, consultă ghidul privind limitele de cheltuieli API.

Verifică limitele de rată aplicabile

Accesează pagina Limite a organizației pentru a verifica nivelul actual de utilizare și limitele acesteia.

Limitele de rată se pot aplica la nivel de organizație și de proiect. Acestea nu sunt cote individuale pentru utilizatori. Limitele diferă și în funcție de model, iar unele familii de modele au o limită comună.

Verifică limita indicată de eroare. De exemplu, solicitările pe minut și tokenurile pe minut au limite distincte. Poți atinge una dintre limite fără să o depășești pe cealaltă.

Confirmă organizația utilizată de solicitare

Dacă faci parte din mai multe organizații, confirmă că solicitările folosesc organizația și proiectul dorite.

Dacă cheia API folosește o organizație prestabilită, verifică setarea organizației prestabilite. Organizațiile pot avea condiții de facturare și niveluri de utilizare diferite.

Redu erorile temporare privind limita de rată

Distribuie solicitările în timp și evită rafalele

Distribuie solicitările în timp, în loc să trimiți multe deodată.

Limitele de rată pot fi aplicate pe perioade mai scurte decât intervalul afișat. De exemplu, o limită de 60 de solicitări pe minut poate fi aplicată și pe intervale de o secundă. Prin urmare, o rafală scurtă poate declanșa o eroare chiar dacă utilizarea medie pare să fie sub limita pe minut.

Solicitările lungi și limitele inutil de mari pentru tokenurile de ieșire pot contribui, de asemenea, la erorile privind rata tokenurilor.

Reîncearcă după o pauză

Pentru erorile temporare privind limita de rată:

  1. Verifică dacă răspunsul conține antetul Retry-After.

  2. Dacă antetul conține un interval valid, așteaptă cel puțin atât înainte de a reîncerca.

  3. Dacă antetul lipsește sau nu este valid, folosește temporizarea exponențială cu variație aleatorie: mărește intervalul după fiecare încercare nereușită și adaugă o mică întârziere aleatorie.

  4. Limitează atât numărul de reîncercări, cât și timpul total alocat acestora.

SDK-urile OpenAI oficiale reîncearcă deja solicitările eligibile afectate de limite de rată și respectă Retry-After când acesta este prezent. Ține cont de aceste reîncercări înainte de a adăuga o altă buclă de reîncercare.

Solicitările nereușite sunt luate în calcul pentru limitele pe minut. Retrimiterea continuă a aceleiași solicitări poate prelungi problema.

Pentru instrucțiuni și exemple de implementare, consultă ghidul privind limitele de rată API. Verifică orice bibliotecă terță de reîncercare înainte de a o folosi în aplicație.

Verifică dimensiunea solicitării și a ieșirii

Elimină din solicitări instrucțiunile inutile, contextul repetat și exemplele. Testează solicitarea revizuită pentru a confirma că produce în continuare rezultatul dorit.

Folosește parametrul pentru tokenurile de ieșire acceptat de punctul final și modelul tău:

  • Chat Completions folosește max_completion_tokens.

  • Responses folosește max_output_tokens.

Evită să stabilești o limită mult mai mare decât necesită solicitarea. Acești parametri includ atât tokenurile de raţionament, cât și ieșirea vizibilă, așa că ține cont de ambele când folosești un model de raţionament.

Verifică nivelul de utilizare

Dacă erorile persistă după ce reduci rafalele și verifici utilizarea tokenurilor, consultă pagina Limite pentru modalitățile disponibile de a-ți mări limitele.

Pe măsură ce cheltuielile API cresc, OpenAI poate trece automat organizația la un nivel de utilizare superior. De obicei, astfel cresc limitele de rată pentru majoritatea modelelor.

Limita lunară de utilizare aprobată este distinctă de limitele de rată pentru solicitări și tokenuri. Mărirea uneia nu trebuie considerată o confirmare a modificării celeilalte.

Dacă problema persistă

Înainte de escaladare

Păstrează la îndemână mesajul exact al erorii, orice cod de eroare, ID-urile relevante ale solicitărilor, ora erorii și fusul orar, precum și limita relevantă afișată în cont. Notează pașii pe care i-ai încercat deja.

Contactează serviciul de asistență OpenAI

Contactează serviciul de asistență OpenAI prin Centrul de asistență dacă nu poți rezolva problema după ce verifici limita raportată. Nu include chei API sau alte date secrete de autentificare.

A fost util acest articol?