Pangkalahatang-ideya
Napapailalim sa mga rate limit ang paggamit ng API. Nililimitahan ng mga ito ang mga request, token, o iba pang paggamit sa loob ng itinakdang panahon.
Maaaring magpahiwatig ang 429 response ng pansamantalang rate limit, naubos na prepaid balance, o limitasyon sa gastos o paggamit. Suriin ang mga detalye ng error bago subukang muli o baguhin ang iyong mga setting sa pagsingil.
Tukuyin ang sanhi
Basahin ang mensahe ng error at ang error.code, kung mayroon. Maaari pa ring gamitin ng mga error na nauugnay sa pagsingil ang mas malawak na error.type value na insufficient_quota.
| Error o code | Ang ibig sabihin nito | Ang dapat gawin |
| Naabot na ang rate limit para sa mga request o token | Lumampas ang mga request sa naaangkop na rate limit. | Ipadala ang mga request sa tamang pagitan at sundin ang gabay sa muling pagsubok sa ibaba. |
| credit_balance_exhausted | Wala nang natitirang prepaid credits ang organisasyon. | Magdagdag ng credits sa iyong mga setting sa pagsingil ng API. |
| organization_usage_limit_exceeded | Naabot ng organisasyon ang limitasyon sa paggamit na itinalaga ng OpenAI. | Humiling ng pag-apruba para sa mas mataas na limitasyon sa paggamit. |
| organization_spend_limit_exceeded | Naabot ng organisasyon ang ipinatutupad nitong limitasyon sa gastos. | Taasan o alisin ang limitasyon, o hintayin ang buwanang pag-reset. |
| project_spend_limit_exceeded | Naabot ng proyekto ang ipinatutupad nitong limitasyon sa gastos. | Taasan o alisin ang limitasyon ng proyekto, o hintayin ang buwanang pag-reset. |
Hindi maibabalik ang access sa muling pagsubok kapag may error sa pagsingil, gastos, o quota. Ayusin muna ang iniulat na balance o limitasyon. Maaaring matagalan bago mailapat ang mga pagbabago sa mga ipinapatupad na limitasyon sa gastos.
Kailangan ng pahintulot na pamahalaan ang nauugnay na mga setting ng organisasyon o proyekto para baguhin ang limitasyon sa gastos. Kung wala kang access, magtanong sa taong namamahala sa mga setting na iyon.
Para sa pagbili ng prepaid credits, tingnan ang: Pag-set up at pamamahala ng prepaid na pagsingil sa API.
Para sa iba't ibang kontrol sa gastos, tingnan ang gabay sa limitasyon sa gastos ng API.
Suriin ang mga naaangkop na rate limit
Pumunta sa page ng Mga Limitasyon ng iyong organisasyon para suriin ang kasalukuyang tier at mga limitasyon sa paggamit nito.
Maaaring ilapat ang mga rate limit sa antas ng organisasyon at proyekto. Hindi hiwalay na allowance ang mga ito para sa bawat user. Nag-iiba rin ang mga limitasyon ayon sa modelo, at may mga pamilya ng modelo na iisa ang limitasyon.
Suriin kung aling limitasyon ang tinutukoy ng error. Halimbawa, magkahiwalay na limitasyon ang mga request kada minuto at mga token kada minuto. Maaari mong maabot ang isa habang nananatili kang mas mababa sa isa pa.
Kumpirmahin ang organisasyong ginagamit ng iyong request
Kung kabilang ka sa maraming organisasyon, kumpirmahing ginagamit ng iyong mga request ang nilalayong organisasyon at proyekto.
Kapag gumagamit ng default na organisasyon ang iyong API key, tingnan ang iyong setting ng default na organisasyon. Maaaring magkakaiba ang mga kaayusan sa pagsingil at tier ng paggamit ng bawat organisasyon.
Bawasan ang mga pansamantalang error sa rate limit
Ipadala ang mga request sa tamang pagitan at iwasan ang biglaang pagdami
Ipamahagi sa iba't ibang oras ang mga request sa halip na magpadala ng marami nang sabay-sabay.
Maaaring ipatupad ang mga rate limit sa mas maiikling panahon kaysa sa ipinapakitang agwat. Halimbawa, maaari ding ipatupad kada 1 segundo ang limitasyong 60 request kada minuto. Dahil dito, maaaring mag-trigger ng error ang biglaang pagdami sa maikling panahon kahit mukhang mas mababa sa limitasyon kada minuto ang iyong average na paggamit.
Maaari ding magdulot ng mga error sa token rate ang mahahabang prompt at di-kinakailangang malalaking allowance sa output token.
Subukang muli pagkatapos maghintay
Para sa mga pansamantalang error sa rate limit:
Tingnan kung may Retry-After response header.
Kung may wastong tagal ng paghihintay sa header, maghintay nang hindi bababa sa ganoon katagal bago subukang muli.
Kung wala o hindi wasto ang header, gumamit ng exponential backoff na may jitter: dagdagan ang tagal ng paghihintay pagkatapos ng bawat nabigong pagtatangka at magdagdag ng maikling random na pagkaantala.
Limitahan ang bilang ng mga muling pagtatangka at ang kabuuang oras na ginugugol sa mga ito.
Awtomatikong sinusubukang muli ng mga opisyal na OpenAI SDK ang mga kwalipikadong error sa rate limit at sinusunod ang Retry-After kapag mayroon nito. Isaalang-alang ang mga muling pagtatangkang iyon bago magdagdag ng isa pang retry loop.
Nabibilang sa mga limitasyon kada minuto ang mga nabigong request. Maaaring tumagal ang problema kung patuloy na muling ipapadala ang parehong request.
Para sa gabay at mga halimbawa ng pagpapatupad, tingnan ang gabay sa API rate limit. Suriin ang anumang third-party retry library bago ito gamitin sa iyong application.
Suriin ang laki ng prompt at output
Alisin sa iyong mga prompt ang mga hindi kinakailangang tagubilin, paulit-ulit na konteksto, at halimbawa. Subukan ang binagong prompt para kumpirmahing naibibigay pa rin nito ang resultang kailangan mo.
Gamitin ang parameter ng output token na sinusuportahan ng iyong endpoint at modelo:
Ginagamit ng Chat Completions ang max_completion_tokens.
Ginagamit ng Responses ang max_output_tokens.
Iwasang magtakda ng allowance na higit na mas malaki kaysa sa kailangan ng request. Kasama sa mga parameter na ito ang mga token ng pangangatwiran at ang nakikitang output, kaya maglaan para sa pareho kapag gumagamit ng nangangatwirang modelo.
Suriin ang iyong tier ng paggamit
Kung nagpapatuloy ang mga error pagkatapos mong bawasan ang biglaang pagdami ng mga request at suriin ang paggamit ng token, tingnan sa iyong page ng Mga Limitasyon ang mga available na paraan para taasan ang iyong mga limitasyon.
Habang tumataas ang gastos sa API, maaaring awtomatikong ilipat ng OpenAI ang isang organisasyon sa mas mataas na tier ng paggamit. Karaniwan nitong itinataas ang mga rate limit sa karamihan ng mga modelo.
Hiwalay ang iyong inaprubahang buwanang limitasyon sa paggamit sa mga rate limit ng request at token. Ang pagtaas sa isa ay hindi dapat ituring na kumpirmasyong nagbago rin ang isa pa.
Kung nagpapatuloy ang problema
Bago humingi ng karagdagang tulong
Ihanda ang eksaktong mensahe ng error, anumang error code, mga nauugnay na request ID, oras ng error kasama ang iyong time zone, at ang nauugnay na limitasyong ipinapakita sa iyong account. Itala ang mga hakbang na nasubukan mo na.
Makipag-ugnayan sa OpenAI Support
Makipag-ugnayan sa OpenAI Support sa pamamagitan ng Help Center kung hindi mo malutas ang problema pagkatapos suriin ang iniulat na limitasyon. Huwag magsama ng mga API key o iba pang lihim na detalye sa authentication.
