OpenAI
Tämä sivu on konekäännetty. Katso alkuperäinen englanninkielinen artikkeli.

API:n pyyntörajojen ja 429-virheiden vianmääritys

Selvitä API:n 429-virheen syy, vähennä pyyntöryöppyjä ja valitse sopiva ratkaisu pyyntö-, krediitti- tai käyttörajoihin.

Päivitetty: 9 days ago

Yleiskatsaus

API:n käyttöä koskevat pyyntörajat. Nämä rajat rajoittavat pyyntöjen, tokenien tai muun käytön määrää tietyllä ajanjaksolla.

429-vastaus voi tarkoittaa tilapäistä pyyntörajaa, käytettyä ennakkomaksusaldoa tai kulutus- tai käyttörajaa. Tarkista virheen tiedot ennen uutta yritystä tai laskutusasetusten muuttamista.

Selvitä syy

Lue virheilmoitus ja error.code, jos se on annettu. Laskutukseen liittyvissä virheissä laajempi error.type-arvo voi edelleen olla insufficient_quota.

Virhe tai koodiMitä se tarkoittaaToimintaohje
Pyyntöjen tai tokenien pyyntöraja saavutettuPyynnöt ylittävät sovellettavan pyyntörajan.Rytmitä pyynnöt ja noudata alla olevia uusintaohjeita.
credit_balance_exhaustedOrganisaation ennakkoon maksetut krediitit ovat loppuneet.Lisää krediittejä API:n laskutusasetuksissa.
organization_usage_limit_exceededOrganisaatio on saavuttanut OpenAI:n määrittämän käyttörajan.Pyydä hyväksytyn käyttörajan korottamista.
organization_spend_limit_exceededOrganisaatio on saavuttanut sille asetetun kulutusrajan.Korota tai poista raja tai odota kuukausittaista nollausta.
project_spend_limit_exceededProjekti on saavuttanut sille asetetun kulutusrajan.Korota tai poista projektin raja tai odota kuukausittaista nollausta.

Uusi yritys ei palauta käyttöoikeutta laskutus-, kulutus- tai kiintiövirheen yhteydessä. Korjaa ensin ilmoitettu saldo tai raja. Asetettujen kulutusrajojen muutosten voimaantulo voi kestää jonkin aikaa.

Kulutusrajan muuttaminen edellyttää oikeutta hallita kyseisen organisaation tai projektin asetuksia. Jos sinulla ei ole käyttöoikeutta, pyydä asetuksia hallinnoivaa henkilöä tekemään muutos.

Lisätietoja ennakkoon maksettavien krediittien ostamisesta: API:n ennakkomaksulaskutuksen määrittäminen ja hallinta.

Eri kulutuksen hallintatavat esitellään API:n kulutusrajojen oppaassa.

Tarkista sovellettavat pyyntörajat

Tarkista organisaation nykyinen käyttötaso ja rajat sen Rajat-sivulta.

Pyyntörajoja voidaan soveltaa organisaatio- ja projektitasolla. Ne eivät ole yksittäisten käyttäjien käyttökiintiöitä. Rajat vaihtelevat myös malleittain, ja joillakin malliperheillä on yhteinen raja.

Tarkista, minkä rajan virhe ilmoittaa. Esimerkiksi pyyntöjen minuuttiraja ja tokenien minuuttiraja ovat erillisiä. Voit saavuttaa toisen rajan ja pysyä samalla toisen alapuolella.

Vahvista pyynnön käyttämä organisaatio

Jos kuulut useisiin organisaatioihin, varmista, että pyyntösi käyttävät oikeaa organisaatiota ja projektia.

Jos API-avaimesi käyttää oletusorganisaatiota, tarkista oletusorganisaation asetus. Eri organisaatioilla voi olla erilaiset laskutusjärjestelyt ja käyttötasot.

Vähennä tilapäisiä pyyntörajoitusvirheitä

Rytmitä pyynnöt ja vältä pyyntöryöppyjä

Jaa pyynnöt pidemmälle aikavälille sen sijaan, että lähettäisit suuren määrän kerralla.

Pyyntörajoja voidaan soveltaa näytettyä aikaväliä lyhyempiin jaksoihin. Esimerkiksi 60 pyynnön minuuttirajaa voidaan soveltaa myös yhden sekunnin jaksoihin. Lyhyt pyyntöryöppy voi siksi aiheuttaa virheen, vaikka keskimääräinen käyttösi näyttäisi alittavan minuuttikohtaisen rajan.

Myös pitkät kehotteet ja tarpeettoman suuret tulostokenien enimmäismäärät voivat aiheuttaa tokenien pyyntörajoitusvirheitä.

Yritä uudelleen viiveen jälkeen

Tilapäisten pyyntörajoitusvirheiden yhteydessä:

  1. Tarkista, sisältääkö vastaus Retry-After-otsakkeen.

  2. Jos otsakkeessa on kelvollinen viive, odota vähintään sen verran ennen uutta yritystä.

  3. Jos otsake puuttuu tai on virheellinen, käytä eksponentiaalista viivettä ja satunnaisvaihtelua: pidennä viivettä jokaisen epäonnistuneen yrityksen jälkeen ja lisää pieni satunnainen viive.

  4. Rajoita sekä uusintayritysten määrää että niihin käytettävää kokonaisaikaa.

OpenAI:n viralliset SDK:t yrittävät jo automaattisesti uudelleen soveltuvien pyyntörajoitusvirheiden yhteydessä ja noudattavat Retry-After-otsaketta, kun se on saatavilla. Ota nämä uusintayritykset huomioon ennen uuden uusintasilmukan lisäämistä.

Epäonnistuneet pyynnöt lasketaan mukaan minuuttikohtaisiin rajoihin. Saman pyynnön jatkuva lähettäminen uudelleen voi pitkittää ongelmaa.

Toteutusohjeita ja esimerkkejä on API:n pyyntörajojen oppaassa. Arvioi kolmannen osapuolen uusintakirjasto ennen sen käyttämistä sovelluksessasi.

Tarkista kehotteen ja tulosteen koko

Poista kehotteista tarpeettomat ohjeet, toistuva konteksti ja tarpeettomat esimerkit. Testaa muokattu kehote ja varmista, että se tuottaa edelleen tarvitsemasi tuloksen.

Käytä endpointin ja mallin tukemaa tulostokenien parametria:

  • Chat Completions käyttää max_completion_tokens-parametria.

  • Responses käyttää max_output_tokens-parametria.

Älä aseta enimmäismäärää paljon pyynnön tarvetta suuremmaksi. Nämä parametrit sisältävät sekä päättelytokenit että näkyvän tulosteen, joten huomioi molemmat päättelymallia käyttäessäsi.

Tarkista käyttötasosi

Jos virheet jatkuvat pyyntöryöppyjen vähentämisen ja tokenien käytön tarkistamisen jälkeen, katso rajojen korotusvaihtoehdot Rajat-sivulta.

API-kulutuksen kasvaessa OpenAI voi siirtää organisaation automaattisesti korkeammalle käyttötasolle. Tämä yleensä nostaa useimpien mallien pyyntörajoja.

Hyväksytty kuukausittainen käyttörajasi on erillinen pyyntöjen ja tokenien pyyntörajoista. Toisen korottaminen ei vahvista, että myös toinen on muuttunut.

Jos ongelma jatkuu

Ennen asian eskalointia

Pidä saatavilla tarkka virheilmoitus, mahdollinen virhekoodi, olennaiset pyyntötunnukset, virheen ajankohta aikavyöhykkeineen sekä tililläsi näkyvä asiaankuuluva raja. Kirjaa ylös jo kokeilemasi ratkaisut.

Ota yhteyttä OpenAI-tukeen

Ota yhteyttä OpenAI-tukeen ohjekeskuksen kautta, jos ongelma ei ratkea ilmoitetun rajan tarkistamisen jälkeen. Älä sisällytä viestiin API-avaimia tai muita todennussalaisuuksia.

Oliko tästä artikkelista apua?