جائزہ
API کا استعمال ریٹ لمٹس کے تابع ہے. یہ حدود ایک مخصوص مدت میں درخواستوں، ٹوکنز یا دیگر استعمال کو محدود کرتی ہیں.
429 جواب عارضی ریٹ لمٹ، پری پیڈ بیلنس ختم ہونے، یا اخراجات یا استعمال کی حد کی نشاندہی کر سکتا ہے. دوبارہ کوشش کرنے یا بلنگ کی ترتیبات تبدیل کرنے سے پہلے خرابی کی تفصیلات دیکھیں.
وجہ معلوم کریں
خرابی کا پیغام اور، اگر فراہم کیا گیا ہو، error.code پڑھیں. بلنگ سے متعلق خرابیوں میں بھی وسیع تر error.type قدر insufficient_quota استعمال ہو سکتی ہے.
| خرابی یا کوڈ | اس کا مطلب | کیا کرنا ہے |
| درخواستوں یا ٹوکنز کی ریٹ لمٹ پوری ہو گئی | درخواستیں قابل اطلاق ریٹ لمٹ سے تجاوز کر رہی ہیں. | درخواستیں وقفے سے بھیجیں اور ذیل میں دی گئی دوبارہ کوشش کی رہنمائی پر عمل کریں. |
| credit_balance_exhausted | تنظیم کے پری پیڈ کریڈٹس ختم ہو چکے ہیں. | اپنی API بلنگ کی ترتیبات میں کریڈٹس شامل کریں. |
| organization_usage_limit_exceeded | تنظیم OpenAI کی مقرر کردہ استعمال کی حد تک پہنچ گئی ہے. | استعمال کی زیادہ منظور شدہ حد کی درخواست کریں. |
| organization_spend_limit_exceeded | تنظیم اخراجات کی نافذ شدہ حد تک پہنچ گئی ہے. | حد بڑھائیں یا ہٹائیں، یا ماہانہ ازسرنو ترتیب کا انتظار کریں. |
| project_spend_limit_exceeded | پروجیکٹ اخراجات کی نافذ شدہ حد تک پہنچ گیا ہے. | پروجیکٹ کی حد بڑھائیں یا ہٹائیں، یا ماہانہ ازسرنو ترتیب کا انتظار کریں. |
بلنگ، اخراجات یا کوٹے کی خرابی پر دوبارہ کوشش کرنے سے رسائی بحال نہیں ہوتی. پہلے بتائے گئے بیلنس یا حد کا مسئلہ حل کریں. اخراجات کی نافذ شدہ حدود میں تبدیلی لاگو ہونے میں وقت لگ سکتا ہے.
اخراجات کی حد تبدیل کرنے کے لیے متعلقہ تنظیم یا پروجیکٹ کی ترتیبات کا نظم کرنے کی اجازت درکار ہوتی ہے. اگر آپ کو رسائی حاصل نہیں تو ان ترتیبات کا نظم کرنے والے شخص سے کہیں.
پری پیڈ کریڈٹس کی خریداری کے لیے دیکھیں: پری پیڈ API بلنگ ترتیب دینا اور اس کا نظم کرنا.
اخراجات کے مختلف کنٹرولز کے لیے API اخراجات کی حد کا رہنما دیکھیں.
قابل اطلاق ریٹ لمٹس دیکھیں
موجودہ استعمال کا درجہ اور حدود دیکھنے کے لیے اپنی تنظیم کے حدود کے صفحے پر جائیں.
ریٹ لمٹس تنظیم اور پروجیکٹ دونوں سطحوں پر لاگو ہو سکتی ہیں. یہ انفرادی صارف کے لیے مختص حدود نہیں ہیں. حدود ماڈل کے لحاظ سے بھی مختلف ہوتی ہیں، اور ماڈلز کے بعض خاندان ایک ہی حد استعمال کرتے ہیں.
دیکھیں کہ خرابی میں کس حد کی نشاندہی کی گئی ہے. مثلاً، فی منٹ درخواستوں اور فی منٹ ٹوکنز کی حدود الگ الگ ہیں. آپ دوسری حد سے نیچے رہتے ہوئے کسی ایک حد تک پہنچ سکتے ہیں.
اپنی درخواست میں استعمال ہونے والی تنظیم کی تصدیق کریں
اگر آپ متعدد تنظیموں سے وابستہ ہیں تو تصدیق کریں کہ آپ کی درخواستوں میں مطلوبہ تنظیم اور پروجیکٹ استعمال ہو رہے ہیں.
اگر آپ کی API کلید ایک ڈیفالٹ تنظیم استعمال کرتی ہے تو اپنی ڈیفالٹ تنظیم کی ترتیب دیکھیں. مختلف تنظیموں کے بلنگ انتظامات اور استعمال کے درجات مختلف ہو سکتے ہیں.
عارضی ریٹ لمٹ کی خرابیاں کم کریں
درخواستیں وقفے سے بھیجیں اور اچانک دباؤ سے بچیں
بہت سی درخواستیں ایک ساتھ بھیجنے کے بجائے انہیں وقت کے ساتھ پھیلا کر بھیجیں.
ریٹ لمٹس دکھائے گئے وقفے سے مختصر مدتوں پر بھی نافذ ہو سکتی ہیں. مثلاً، فی منٹ 60 درخواستوں کی حد ایک سیکنڈ کے وقفوں پر بھی نافذ کی جا سکتی ہے. اس لیے مختصر وقت میں درخواستوں کا اچانک دباؤ خرابی پیدا کر سکتا ہے، چاہے آپ کا اوسط استعمال فی منٹ حد سے کم دکھائی دے.
طویل پرومپٹس اور آؤٹ پٹ ٹوکنز کی غیر ضروری طور پر بڑی حد بھی ٹوکن ریٹ کی خرابیوں کا سبب بن سکتی ہے.
وقفے کے بعد دوبارہ کوشش کریں
عارضی ریٹ لمٹ کی خرابیوں کے لیے:
دیکھیں کہ جواب میں Retry-After ہیڈر موجود ہے یا نہیں.
اگر ہیڈر میں درست وقفہ دیا گیا ہے تو دوبارہ کوشش سے پہلے کم از کم اتنی دیر انتظار کریں.
اگر ہیڈر موجود نہیں یا غلط ہے تو بے ترتیبی کے ساتھ افزائشی تاخیر استعمال کریں: ہر ناکام کوشش کے بعد وقفہ بڑھائیں اور اس میں تھوڑا سا بے ترتیب وقفہ شامل کریں.
دوبارہ کوششوں کی تعداد اور ان پر صرف ہونے والے کل وقت، دونوں کو محدود رکھیں.
OpenAI کے سرکاری SDK اہل ریٹ لمٹ خرابیوں پر پہلے ہی دوبارہ کوشش کرتے ہیں اور Retry-After موجود ہونے پر اس کی پابندی کرتے ہیں. ایک اور دوبارہ کوشش کا چکر شامل کرنے سے پہلے ان کوششوں کو مدنظر رکھیں.
ناکام درخواستیں بھی فی منٹ حدود میں شمار ہوتی ہیں. ایک ہی درخواست مسلسل دوبارہ بھیجنے سے مسئلہ زیادہ دیر تک برقرار رہ سکتا ہے.
عمل درآمد کی رہنمائی اور مثالوں کے لیے API ریٹ لمٹ رہنما دیکھیں. اپنی ایپلیکیشن میں فریق ثالث کی دوبارہ کوشش کی لائبریری استعمال کرنے سے پہلے اس کا جائزہ لیں.
پرومپٹ اور آؤٹ پٹ کے حجم کا جائزہ لیں
اپنے پرومپٹس سے غیر ضروری ہدایات، دہرایا گیا سیاق و سباق اور مثالیں ہٹا دیں. ترمیم شدہ پرومپٹ آزما کر تصدیق کریں کہ وہ اب بھی مطلوبہ نتیجہ پیدا کرتا ہے.
اپنے اینڈپوائنٹ اور ماڈل کا معاونت یافتہ آؤٹ پٹ ٹوکن پیرامیٹر استعمال کریں:
چیٹ کمپلیشنز max_completion_tokens استعمال کرتا ہے.
رسپانسز max_output_tokens استعمال کرتا ہے.
درخواست کی ضرورت سے کہیں زیادہ بڑی حد مقرر نہ کریں. ان پیرامیٹرز میں ریزننگ ٹوکنز کے ساتھ دکھائی دینے والا آؤٹ پٹ بھی شامل ہوتا ہے، اس لیے ریزننگ ماڈل استعمال کرتے وقت دونوں کی گنجائش رکھیں.
اپنے استعمال کے درجے کا جائزہ لیں
اگر درخواستوں کا اچانک دباؤ کم کرنے اور ٹوکن استعمال کا جائزہ لینے کے بعد بھی خرابیاں جاری رہیں تو حدود بڑھانے کے دستیاب طریقوں کے لیے اپنا حدود کا صفحہ دیکھیں.
API پر اخراجات بڑھنے کے ساتھ OpenAI کسی تنظیم کو خودکار طور پر استعمال کے اعلیٰ درجے میں منتقل کر سکتا ہے. اس سے عموماً بیشتر ماڈلز کی ریٹ لمٹس بڑھ جاتی ہیں.
آپ کی منظور شدہ ماہانہ استعمال کی حد، درخواست اور ٹوکن کی ریٹ لمٹس سے الگ ہے. ایک حد بڑھنے کو اس بات کی تصدیق نہ سمجھیں کہ دوسری بھی بدل گئی ہے.
اگر مسئلہ برقرار رہے
مسئلہ آگے بڑھانے سے پہلے
خرابی کا عین پیغام، خرابی کا کوئی بھی کوڈ، متعلقہ درخواست شناخت کار، اپنے ٹائم زون سمیت خرابی کا وقت، اور اپنے اکاؤنٹ میں دکھائی گئی متعلقہ حد دستیاب رکھیں. ان اقدامات کو نوٹ کر لیں جو آپ پہلے ہی آزما چکے ہیں.
OpenAI معاونت سے رابطہ کریں
اگر بتائی گئی حد دیکھنے کے بعد بھی مسئلہ حل نہ ہو تو ہیلپ سینٹر کے ذریعے OpenAI معاونت سے رابطہ کریں. API کلیدیں یا تصدیق کے دیگر خفیہ کوائف شامل نہ کریں.
