OpenAI
اس صفحے کا مشینی ترجمہ کیا گیا تھا. اصل انگریزی مضمون دیکھیں.

فاسٹ موڈ کے عمومی سوالات

فاسٹ موڈ اور الٹرا فاسٹ سروس ٹیئر کے بارے میں اکثر پوچھے جانے والے سوالات.

آخری اپ ڈیٹ: 4 days ago

ہم ان API صارفین کے لیے فاسٹ موڈ پیش کرتے ہیں جو مخصوص ماڈلز پر زیادہ تیز اور یکساں کارکردگی چاہتے ہیں. ذیل میں اس کے کام کرنے کے طریقے، قیمتوں، ماڈلز کی دستیابی، ریٹ لمٹس، قابل اعتماد کارکردگی، پالیسیوں اور اہلیت سے متعلق عام سوالات کے جواب دیے گئے ہیں.

نوٹ: ترجیحی پروسیسنگ کا نام 30 جولائی 2026 کو بدل کر فاسٹ موڈ کر دیا گیا تھا. آپ اپنی API درخواستوں میں service_tier: priority یا service_tier: fast، دونوں میں سے کوئی بھی استعمال کر سکتے ہیں. 

مزید معلومات یہاں حاصل کریں.

کیا فاسٹ موڈ تمام خطوں میں دستیاب ہے.

ہر دائرۂ اختیار میں فاسٹ موڈ کی دستیابی وہاں نافذ قوانین و ضوابط پر منحصر ہے. اپنے خطے میں دستیابی کے بارے میں سوالات ہوں تو براہ کرم اپنے اکاؤنٹ ڈائریکٹر سے رابطہ کریں.

یہ کیسے کام کرتا ہے

صارفین موجودہ service_tier پیرامیٹر میں service_tier = "fast" کا اختیار استعمال کرکے ہر درخواست کی سطح پر ٹریفک فاسٹ موڈ کو بھیج سکتے ہیں.

فاسٹ موڈ میں پروسیس کیے گئے ٹوکن کی بلنگ فی ٹوکن کی بنیاد پر ہوگی، اور قیمت معیاری پروسیسنگ کی شرحوں سے زیادہ ہوگی.

ہر درخواست کی سطح پر ترتیب دینے کے علاوہ، آپ پروجیکٹ کی ترتیبات > طے شدہ سروس ٹیئر: فاسٹ میں جا کر کسی پروجیکٹ کے لیے فاسٹ موڈ کو طے شدہ بھی بنا سکتے ہیں. اس کے بعد بھی آپ ہر درخواست کے لیے یہ ترتیب بدل سکتے ہیں. پروجیکٹ کی ترتیبات میں فاسٹ منتخب کرنا ترجیحی منتخب کرنے کے برابر ہے.

یہ اسکیل ٹیئر کے ساتھ کیسے کام کرتا ہے.

اسکیل ٹیئر فاسٹ موڈ سے الگ رہے گا. فاسٹ موڈ کو بھیجی گئی درخواستوں کی بلنگ الگ ہوگی اور انہیں آپ کے خریدے ہوئے اسکیل ٹیئر کے ٹوکن فی منٹ بنڈلز میں شمار نہیں کیا جائے گا.

کیا میں اسکیل ٹیئر کی گنجائش سے زائد ٹریفک خودکار طور پر فاسٹ موڈ کو بھیج سکتا ہوں.

نہیں. اسکیل ٹیئر کو بھیجی گئی ٹریفک گنجائش سے بڑھنے پر خودکار طور پر فاسٹ موڈ میں منتقل نہیں ہوگی.

فاسٹ موڈ کی بلنگ کیسے ہوتی ہے.

فاسٹ موڈ میں پروسیس کیے گئے ٹوکن کی بلنگ فی ٹوکن کی بنیاد پر ہوگی، اور قیمت معیاری پروسیسنگ کی شرحوں سے زیادہ ہوگی.

کیا سالانہ اخراجات کا میرا معاہدہ کسی مخصوص پروسیسنگ موڈ سے وابستہ ہے.

نہیں. تمام پروسیسنگ موڈز کے اخراجات آپ کے انٹرپرائز معاہدے میں طے شدہ سالانہ اخراجات میں شمار ہوتے ہیں.

کیا کیش شدہ اِن پٹ ٹوکن پر اب بھی رعایت ملتی ہے.

جی ہاں. کیش شدہ اِن پٹ پر معیاری پروسیسنگ کی طرح ہی 50-75% رعایت ملتی ہے.

میں فاسٹ موڈ کے اپنے استعمال اور اخراجات کو کیسے دیکھوں.

فاسٹ موڈ (جسے پہلے ترجیحی پروسیسنگ کہا جاتا تھا) میں پروسیس کیے گئے ٹوکن دیکھنے کے لیے استعمال کے ڈیش بورڈ پر جائیں، چیٹ کی تکمیل یا جوابات منتخب کریں، اور سروس ٹیئر کے لحاظ سے گروپ بنائیں.

فاسٹ موڈ کی لاگت دیکھنے کے لیے استعمال کے ڈیش بورڈ پر جائیں اور مد کے لحاظ سے گروپ بنانے کا اختیار منتخب کریں.

استعمال کے ڈیش بورڈ پر، وہ درخواستیں جن میں service_tier کی قدر priority یا fast ہو، بدستور priority کے طور پر دکھائی جائیں گی. آئندہ آنے والے ماڈلز کے لیے اس میں تبدیلی کی جائے گی.

ماڈلز

کیا فاسٹ موڈ طویل سیاق، مخصوص تربیت سے بہتر بنائے گئے ماڈلز، ایمبیڈنگز وغیرہ کے لیے دستیاب ہے.

فی الحال نہیں. ہم مستقبل میں جائزہ لیں گے کہ اپنے جدید ترین ماڈلز کے علاوہ دیگر مصنوعات پر بھی فاسٹ موڈ فراہم کیا جائے یا نہیں.

فاسٹ موڈ میں دیگر اقسام کا ڈیٹا کیسے استعمال ہوتا ہے.

فاسٹ موڈ میں مختلف اقسام کے ڈیٹا کے ساتھ کام کرنے کی وہی صلاحیتیں دستیاب ہیں جو معیاری موڈ میں ہیں. خاص طور پر، ترجیحی پروسیسنگ میں تصاویر کو اِن پٹ کے طور پر استعمال کیا جا سکتا ہے اور ان کی پروسیسنگ بھی اتنے ہی کم وقت میں ہوتی ہے.

کیا آئندہ آنے والے ماڈلز کے لیے بھی معاونت فراہم کی جائے گی.

ہم نئے GPT ماڈلز پر فاسٹ موڈ فراہم کرنے کا ارادہ رکھتے ہیں، لیکن ہر ماڈل کے لیے اس کی دستیابی کی ضمانت نہیں دیتے.

ریٹ لمٹس

ریٹ لمٹس کیا ہیں.

ریٹ لمٹس کے لحاظ سے ترجیحی پروسیسنگ کا استعمال بھی عام اے پی آئی ٹریفک کی طرح شمار ہوتا ہے.

ریمپ ریٹ کی حدیں کیا ہیں.

فاسٹ موڈ میں ریمپ ریٹ کی حدیں مقرر ہیں تاکہ تمام صارفین کو مسلسل اعلیٰ کارکردگی ملے اور ساتھ ہی ضرورت کے مطابق استعمال پر لچکدار قیمتوں کی سہولت بھی برقرار رہے. اگر (الف) فاسٹ موڈ کی کارکردگی کم ہو جائے اور ساتھ ہی (ب) کسی صارف کی ٹریفک بہت تیزی سے بڑھ رہی ہو، تو شاذونادر کچھ درخواستیں اس کے بجائے معیاری پروسیسنگ پر منتقل کی جا سکتی ہیں.

فاسٹ موڈ کی موجودہ ریمپ ریٹ کی حد یہاں ہماری بنیادی دستاویزات میں بیان کی گئی ہے.

ریمپ ریٹ کی حد کے اندر رہنے کے بہترین طریقے

ماڈل تبدیل کرتے وقت ٹریفک بتدریج بڑھائیں. مثلاً، اگر آپ کی ایپلی کیشن پچھلے اسنیپ شاٹ سے نئے اسنیپ شاٹ پر منتقل ہو رہی ہے، تو فیچر فلیگ استعمال کرکے ٹریفک کو ایک ہی بار منتقل کرنے کے بجائے چند گھنٹوں میں بتدریج منتقل کریں.

فاسٹ موڈ پر بڑے پیمانے کی ڈیٹا پروسیسنگ یا غیر ہم وقت کام چلانے سے گریز کریں. یہ کام ٹریفک بہت تیزی سے بڑھا سکتے ہیں، اور اکثر انہیں فاسٹ موڈ کی بہتر کارکردگی کی ضرورت نہیں ہوتی.

اگر آپ بار بار ریمپ ریٹ کی حدوں تک پہنچ جاتے ہیں، تو اس کے بجائے اسکیل ٹیئر کوٹہ خریدنے پر غور کریں.

کیا میرے تمام پروجیکٹس یا تنظیموں پر ریمپ ریٹ کی مشترکہ حدیں لاگو ہوتی ہیں.

جی ہاں، آپ کی تمام ٹریفک ایک ہی ریمپ ریٹ کی حد میں شمار ہوتی ہے.

پالیسیاں

اگر فاسٹ موڈ جواب دینے کے مقررہ وقت کا ہدف پورا نہ کرے تو کیا ہوگا.

کسی بھی سوال یا تشویش کی صورت میں براہِ کرم اپنے اے ڈی سے رابطہ کریں. فاسٹ موڈ کے سروس کی سطح کے معاہدوں پر اسکیل ٹیئر کے انہی معاہدوں جیسے قواعد لاگو ہوں گے؛ اگر ہم کسی مقررہ مدت کے دوران انٹرپرائز معاہدوں والے صارفین کے لیے ان شرائط کو پورا نہ کر سکیں تو سروس کریڈٹس دیے جائیں گے.

کیا فاسٹ موڈ ڈیٹا ریزیڈنسی کے ساتھ مطابقت رکھتا ہے.

جی ہاں.

کیا فاسٹ موڈ زیڈ ڈی آر اور بی اے اے کے ساتھ مطابقت رکھتا ہے.

جی ہاں.

GPT-6 Astra کے لیے الٹرا فاسٹ

الٹرا فاسٹ ان کاموں کے لیے ایک الگ سروس ٹیئر ہے جن میں GPT-6 Astra سے کم وقت میں جواب درکار ہوتا ہے، جیسے تعاملی ایپلی کیشنز اور کوڈنگ کے سلسلہ ہائے کار.

فاسٹ موڈ کی قیمتوں، ریٹ لمٹ اور پالیسی سے متعلق ہدایات ان درخواستوں پر لاگو ہوتی ہیں جن میں service_tier="fast" استعمال ہوتا ہے. الٹرا فاسٹ کی درخواستیں الگ service_tier="ultrafast" ٹیئر استعمال کرتی ہیں.

میں الٹرا فاسٹ کی درخواست کیسے بھیجوں.

جس تنظیم کو الٹرا فاسٹ تک رسائی حاصل ہو، اس کے لیے ریسپانسز اے پی آئی میں یہ ترتیبات استعمال کریں:

  • ماڈل: gpt-6-astra

  • سروس ٹیئر: ultrafast

  • درخواست کا ہیڈر: OpenAI-Service-Tier: ultrafast

سروس ٹیئر کی ترتیب کے علاوہ درخواست کا ہیڈر بھی ضروری ہے.

ٹول کالز چلانے والی ایپلی کیشنز میں، ویب ساکٹ موڈ کی مدد سے آپ مختلف باریوں میں ایک ہی کنکشن دوبارہ استعمال کر سکتے ہیں اور کنکشن قائم کرنے میں لگنے والے اضافی وسائل کم کر سکتے ہیں.

کیا میں دیگر سروس ٹیئرز کے لیے بھی یہی درخواست ہیڈر استعمال کر سکتا ہوں.

الٹرا فاسٹ کے الفا مرحلے میں، OpenAI-Service-Tier ہیڈر صرف ultrafast قبول کرتا ہے. default، fast یا flex سمیت کوئی بھی دوسری قدر بھیجنے پر HTTP 400 کی خرابی موصول ہوتی ہے. کسی دوسرے ٹیئر کا استعمال کرتے وقت یہ ہیڈر شامل نہ کریں.

کیا میں کام یا Codex میں الٹرا فاسٹ استعمال کر سکتا ہوں.

اہل منصوبوں اور ورک اسپیسز کے لیے الٹرا فاسٹ کام اور Codex میں بھی دستیاب ہے. ChatGPT منصوبوں کی اہلیت اور استعمال کے قواعد اے پی آئی تک رسائی کے قواعد سے مختلف ہیں.

دستیابی اور استعمال کی تفصیلات کے لیے ChatGPT کام اور Codex دیکھیں.

کیا یہ آرٹیکل مددگار تھا؟