OpenAI
यह पेज मशीन द्वारा अनुवादित है. मूल अंग्रेज़ी आर्टिकल देखें.

API रेट लिमिट और 429 त्रुटियों का समाधान

API 429 त्रुटि का कारण पहचानें, अनुरोधों की अचानक बढ़ोतरी घटाएं और रेट, क्रेडिट या उपयोग सीमा के लिए सही अगला कदम चुनें.

अपडेट किया गया: 17 days ago

खास जानकारी

API के उपयोग पर रेट लिमिट लागू होती हैं. ये सीमाएं एक निश्चित अवधि के दौरान अनुरोधों, टोकन या अन्य उपयोग को सीमित करती हैं.

429 प्रतिक्रिया अस्थायी रेट लिमिट, प्रीपेड बैलेंस समाप्त होने या खर्च अथवा उपयोग की सीमा तक पहुंचने का संकेत दे सकती है. दोबारा कोशिश करने या बिलिंग सेटिंग बदलने से पहले त्रुटि का विवरण जांचें.

कारण पहचानें

त्रुटि संदेश और उपलब्ध होने पर error.code पढ़ें. बिलिंग से जुड़ी त्रुटियों में भी व्यापक error.type मान insufficient_quota हो सकता है.

त्रुटि या कोडइसका क्या अर्थ हैक्या करें
अनुरोधों या टोकन की रेट लिमिट पूरी हो गईअनुरोध लागू रेट लिमिट से अधिक हो रहे हैं.अनुरोधों की गति नियंत्रित करें और नीचे दिए गए पुनः प्रयास निर्देशों का पालन करें.
credit_balance_exhaustedसंगठन के पास कोई प्रीपेड क्रेडिट्स शेष नहीं हैं.अपनी API बिलिंग सेटिंग में क्रेडिट्स जोड़ें.
organization_usage_limit_exceededसंगठन OpenAI द्वारा निर्धारित उपयोग सीमा तक पहुंच गया है.अधिक स्वीकृत उपयोग सीमा का अनुरोध करें.
organization_spend_limit_exceededसंगठन लागू खर्च सीमा तक पहुंच गया है.सीमा बढ़ाएं या हटाएं, अथवा मासिक रीसेट की प्रतीक्षा करें.
project_spend_limit_exceededप्रोजेक्ट लागू खर्च सीमा तक पहुंच गया है.प्रोजेक्ट की सीमा बढ़ाएं या हटाएं, अथवा मासिक रीसेट की प्रतीक्षा करें.

बिलिंग, खर्च या कोटा संबंधी त्रुटि पर दोबारा कोशिश करने से ऐक्सेस बहाल नहीं होता. पहले बताई गई बैलेंस या सीमा संबंधी समस्या हल करें. लागू खर्च सीमा में किए गए बदलाव प्रभावी होने में समय लग सकता है.

खर्च सीमा बदलने के लिए संबंधित संगठन या प्रोजेक्ट की सेटिंग प्रबंधित करने की अनुमति चाहिए. अगर आपके पास ऐक्सेस नहीं है, तो इन सेटिंग को प्रबंधित करने वाले व्यक्ति से कहें.

प्रीपेड क्रेडिट खरीदने के लिए देखें: प्रीपेड API बिलिंग सेट अप और प्रबंधित करना.

अलग-अलग खर्च नियंत्रणों के लिए API खर्च सीमा गाइड देखें.

लागू रेट लिमिट जांचें

मौजूदा उपयोग स्तर और सीमाओं की समीक्षा करने के लिए अपने संगठन के सीमाएं पेज पर जाएं.

रेट लिमिट संगठन और प्रोजेक्ट, दोनों स्तरों पर लागू हो सकती हैं. ये अलग-अलग उपयोगकर्ताओं को मिलने वाली सीमाएं नहीं हैं. सीमाएं मॉडल के अनुसार भी अलग होती हैं और कुछ मॉडल परिवारों की सीमा साझा होती है.

जांचें कि त्रुटि किस सीमा का उल्लेख करती है. उदाहरण के लिए, प्रति मिनट अनुरोध और प्रति मिनट टोकन अलग-अलग सीमाएं हैं. इनमें से एक सीमा पूरी हो सकती है, जबकि दूसरी से आपका उपयोग कम रहे.

पुष्टि करें कि आपके अनुरोध में सही संगठन का उपयोग हुआ है

अगर आप कई संगठनों से जुड़े हैं, तो पुष्टि करें कि आपके अनुरोध सही संगठन और प्रोजेक्ट का उपयोग कर रहे हैं.

अगर आपकी API कुंजी किसी डिफ़ॉल्ट संगठन का उपयोग करती है, तो अपनी डिफ़ॉल्ट संगठन सेटिंग जांचें. अलग-अलग संगठनों की बिलिंग व्यवस्था और उपयोग स्तर अलग हो सकते हैं.

अस्थायी रेट लिमिट त्रुटियां कम करें

अनुरोधों की गति नियंत्रित करें और अचानक बढ़ोतरी से बचें

एक साथ बहुत सारे अनुरोध भेजने के बजाय उन्हें समय के साथ अलग-अलग भेजें.

रेट लिमिट, दिखाई गई अवधि से छोटी अवधियों पर भी लागू की जा सकती हैं. उदाहरण के लिए, प्रति मिनट 60 अनुरोधों की सीमा 1 सेकंड की अवधियों पर भी लागू की जा सकती है. इसलिए थोड़े समय में अनुरोध अचानक बढ़ने से त्रुटि हो सकती है, भले ही आपका औसत उपयोग प्रति-मिनट सीमा से कम दिखाई दे.

लंबे प्रॉम्प्ट और आउटपुट टोकन के लिए अनावश्यक रूप से बड़ी सीमा भी टोकन-रेट संबंधी त्रुटियों का कारण बन सकती है.

कुछ देर बाद दोबारा कोशिश करें

अस्थायी रेट लिमिट त्रुटियों के लिए:

  1. जांचें कि प्रतिक्रिया में Retry-After हेडर है या नहीं.

  2. अगर हेडर में मान्य विलंब दिया गया है, तो दोबारा कोशिश करने से पहले कम-से-कम उतनी देर प्रतीक्षा करें.

  3. अगर हेडर मौजूद नहीं है या अमान्य है, तो यादृच्छिक विलंब के साथ एक्सपोनेंशियल बैकऑफ़ अपनाएं: हर असफल कोशिश के बाद विलंब बढ़ाएं और उसमें थोड़ा यादृच्छिक विलंब जोड़ें.

  4. दोबारा कोशिशों की संख्या और उनमें लगने वाले कुल समय, दोनों को सीमित रखें.

OpenAI के आधिकारिक SDK योग्य रेट लिमिट त्रुटियों पर पहले से दोबारा कोशिश करते हैं और Retry-After मौजूद होने पर उसका पालन करते हैं. एक और पुनः प्रयास लूप जोड़ने से पहले उन कोशिशों को ध्यान में रखें.

असफल अनुरोध भी प्रति-मिनट सीमाओं में गिने जाते हैं. एक ही अनुरोध को लगातार दोबारा भेजने से समस्या लंबे समय तक बनी रह सकती है.

कार्यान्वयन संबंधी निर्देशों और उदाहरणों के लिए API रेट लिमिट गाइड देखें. अपने ऐप्लिकेशन में किसी तीसरे पक्ष की पुनः प्रयास लाइब्रेरी का उपयोग करने से पहले उसकी समीक्षा करें.

प्रॉम्प्ट और आउटपुट के आकार की समीक्षा करें

अपने प्रॉम्प्ट से अनावश्यक निर्देश, दोहराया गया संदर्भ और उदाहरण हटाएं. संशोधित प्रॉम्प्ट की जांच करके पुष्टि करें कि वह अब भी आपका अपेक्षित परिणाम देता है.

अपने एंडपॉइंट और मॉडल द्वारा समर्थित आउटपुट-टोकन पैरामीटर का उपयोग करें:

  • Chat Completions में max_completion_tokens का उपयोग होता है.

  • Responses में max_output_tokens का उपयोग होता है.

अनुरोध की ज़रूरत से बहुत बड़ी सीमा तय न करें. इन पैरामीटर में रीज़निंग टोकन के साथ दिखाई देने वाला आउटपुट भी शामिल होता है, इसलिए रीज़निंग मॉडल का उपयोग करते समय दोनों के लिए जगह रखें.

अपने उपयोग स्तर की समीक्षा करें

अनुरोधों की अचानक बढ़ोतरी घटाने और टोकन उपयोग की समीक्षा करने के बाद भी त्रुटियां आती रहें, तो सीमाएं बढ़ाने के उपलब्ध तरीकों के लिए अपना सीमाएं पेज देखें.

API खर्च बढ़ने पर OpenAI किसी संगठन को अपने-आप उच्च उपयोग स्तर पर पहुंचा सकता है. इससे आम तौर पर ज़्यादातर मॉडलों की रेट लिमिट बढ़ जाती हैं.

आपकी स्वीकृत मासिक उपयोग सीमा, अनुरोध और टोकन रेट लिमिट से अलग है. किसी एक के बढ़ने को दूसरे में बदलाव की पुष्टि न मानें.

अगर समस्या बनी रहती है

समस्या आगे भेजने से पहले

सटीक त्रुटि संदेश, त्रुटि कोड, संबंधित अनुरोध आईडी, अपने समय क्षेत्र सहित त्रुटि का समय और अपने खाते में दिखाई गई संबंधित सीमा की जानकारी तैयार रखें. आप अब तक जो कदम आज़मा चुके हैं, उन्हें लिख लें.

OpenAI सहायता से संपर्क करें

बताई गई सीमा जांचने के बाद भी समस्या हल न हो, तो हेल्प सेंटर के ज़रिए OpenAI सहायता से संपर्क करें. API कुंजियां या प्रमाणीकरण से जुड़ी अन्य गोपनीय जानकारी शामिल न करें.

क्या यह लेख मददगार था?