نوٹ: یہ مضمون ایک اعلیٰ سطحی جائزہ فراہم کرتا ہے. تکنیکی سیٹ اپ کی معلومات gpt-oss ویب سائٹ، GitHub، Hugging Face، اور OpenAI Cookbooks پر مل سکتی ہیں.
جائزہ
دو اوپن ویٹ ریزننگ ماڈلز متعارف کرائے جا رہے ہیں: gpt‑oss‑120b اور gpt‑oss‑20b. یہ آپ کے زیرِ کنٹرول انفراسٹرکچر پر یا ہوسٹنگ فراہم کنندگان کے ذریعے چلتے ہیں.
نوٹ: یہ ماڈلز OpenAI API کے ذریعے سروس نہیں کیے جاتے اور ChatGPT میں دستیاب نہیں ہیں۔
اوپن ویٹس کیوں
انتخاب اور کنٹرول: ماڈلز کو آن پریمسز یا اپنے پرائیویٹ کلاؤڈ میں چلائیں، ڈیٹا ریزیڈنسی برقرار رکھیں، اور کارکردگی کو اپنی ضروریات کے مطابق ڈھالیں.
کسٹمائزیشن: ماڈلز کو اپنے پسندیدہ اوپن ٹولنگ کے ساتھ فائن ٹیون یا ڈھالیں.
دستیابی اور لائسنسنگ
لائسنس: Apache 2.0 وسیع استعمال، ترمیم، اور دوبارہ تقسیم کی اجازت دیتا ہے، بشمول تجارتی استعمال (ہماری gpt-oss استعمال پالیسی کے تابع).
سروِنگ: OpenAI API کے ذریعے دستیاب نہیں، اس لیے API قیمتیں اور ریٹ لمٹس لاگو نہیں ہوتیں.
مطابقت: vLLM، Ollama، llama.cpp جیسے عام اوپن انفیرنس اسٹیکس، اور کلاؤڈ یا سیلف منیجڈ GPU ماحولیات میں چلایا جا سکتا ہے.
شروع کرنا
ماڈل ویٹس اور معاون وسائل حاصل کرنے کے لیے آپ یہ کر سکتے ہیں:
جائزے اور براہِ راست لنکس کے لیے gpt-oss ویب سائٹ دیکھیں.
Hugging Face کلیکشن سے ویٹس ڈاؤن لوڈ کریں — یہ ایک کمیونٹی ہب ہے جہاں آپ دونوں ماڈلز تلاش کر سکتے ہیں، استعمال کی مثالیں دیکھ سکتے ہیں، اور اختیاری طور پر Hugging Face کی سروسز کے ذریعے براہِ راست انفیرنس چلا سکتے ہیں.
ریفرنس انفیرنس کوڈ کے لیے ہمارے GitHub ریپو تک رسائی حاصل کریں.
Ollama، vLLM، اور Transformers جیسے معاون رن ٹائمز کے ساتھ سیٹ اپ کے لیے OpenAI Cookbook میں گائیڈز استعمال کریں. Cookbook میں لوکل طور پر چلانے، عام رن ٹائمز استعمال کرنے، اور—جہاں معاونت ہو—gpt‑oss ماڈلز کی فائن ٹیوننگ کے لیے مرحلہ وار ہدایات بھی شامل ہیں.
gpt‑oss‑safeguard (ریسرچ پری ویو)
gpt‑oss‑safeguard، gpt‑oss کے اوپر بنائے گئے اوپن ویٹ حفاظتی ریزننگ ماڈلز کی ایک جوڑی ہے. انہیں پالیسی پر مبنی حفاظتی درجہ بندی اور متعلقہ ٹرسٹ & سیفٹی کاموں کے لیے ڈیزائن کیا گیا ہے، جنہیں آپ اپنے زیرِ کنٹرول انفراسٹرکچر پر چلاتے ہیں. دیگر gpt‑oss ماڈلز کی طرح، یہ ویٹس OpenAI API یا ChatGPT کے ذریعے پیش نہیں کیے جاتے.
صرف متن والے ماڈلز ریفرنس اسٹرکچرڈ آؤٹ پٹ اسکیماز کے ساتھ (مثلاً پالیسی فیصلہ، وجہ).
اپنی پالیسی لائیں: ماڈل آپ کی تحریری پالیسی کو سمجھتا ہے تاکہ کم سے کم انجینئرنگ کے ساتھ مختلف مصنوعات پر عمومی اطلاق کر سکے.
استدلالی فیصلے: ڈیبگنگ اور آڈٹس میں مدد کے لیے اختیاری ریزننگ ٹریسز (ڈویلپرز اور حفاظتی ماہرین کے لیے، آخری صارف کو دکھانے کے لیے نہیں).
قابلِ ترتیب ریزننگ کوشش: تاخیر اور گہرائی کے توازن کے لیے کم / درمیانی / زیادہ منتخب کریں.
لائسنس: Apache 2.0 (نیچے دستیابی اور لائسنسنگ دیکھیں).
gpt‑oss‑safeguard LLMs کے لیے ان پٹ/آؤٹ پٹ فلٹرنگ، آن لائن مواد کی لیبلنگ، اور آف لائن بیچ لیبلنگ یا ریویو ورک فلوز کے لیے موزوں ہے. عام ایپلیکیشنز (چیٹ، ایجنٹس، وغیرہ) کے لیے ہم بنیادی gpt‑oss ماڈلز کی سفارش کرتے ہیں.
آپ اسکیما کو اپنی ضروریات کے مطابق ڈھال سکتے ہیں. پرومپٹنگ سے متعلق گائیڈز اور مثالوں کے لیے براہِ کرم OpenAI Cookbook دیکھیں.
ماڈل ویریئنٹس & سائزنگ
| ماڈل | مطلوبہ استعمال | نوٹس |
|---|---|---|
| gpt‑oss‑safeguard‑120b | پروڈکشن، اعلیٰ صلاحیت والی حفاظتی ریزننگ | 117B پیرامیٹرز (≈5.1B فعال). اسے ایک 80 GB GPU پر فٹ ہونے کے لیے ڈیزائن کیا گیا ہے (مثلاً NVIDIA H100؛ AMD MI300X جیسے زیادہ میموری والے GPUs پر بھی چلتا ہے). |
| gpt‑oss‑safeguard‑20b | کم تاخیر / محدود ماحولیات | 21B پیرامیٹرز (≈3.6B فعال). |
دونوں ماڈلز gpt‑oss سے فائن ٹیون کیے گئے ہیں، بغیر کسی آرکیٹیکچر تبدیلی کے. یہ gpt‑oss جیسا ہی چیٹ ٹیمپلیٹ استعمال کرتے ہیں؛ آپ اپنا موجودہ سیٹ اپ برقرار رکھ سکتے ہیں. تجویز کردہ پرومپٹنگ پیٹرن یہ ہے کہ اپنی پالیسی ڈویلپر میسج میں اور جانچنے والا مواد یوزر میسج میں رکھیں.
سپورٹ اور کمیونٹی
اوپن ویٹ تعیناتیاں خود منظم اور خود سروسڈ ہوتی ہیں. سپورٹ حاصل کرنے کے مقامات یہ ہیں:
سوالات، گفتگو، تجاویز: کمیونٹی سے رابطے کے لیے Hugging Face ماڈل صفحات استعمال کریں.
OpenAI کے ریفرنس انفیرنس کوڈ میں دوبارہ پیدا ہونے والے بگز: gpt-oss GitHub ریپو پر ایک ایشو کھولیں.
تھرڈ پارٹی رن ٹائم کے مسائل (مثلاً vLLM، Ollama، llama.cpp): متعلقہ پروجیکٹ کا ایشو ٹریکر، فورمز، یا سپورٹ عمل استعمال کریں.
OpenAI کسی بھی سیلف ہوسٹڈ یا تھرڈ پارٹی ہوسٹڈ اوپن ویٹ سیٹ اپس، کنفیگریشنز، ماحولیات، یا ایپلیکیشنز کے لیے مدد، عملی نفاذ، یا ڈیبگنگ سپورٹ فراہم نہیں کرتا.
ہم ROOST Model Community (RMC) کے ذریعے بھی کمیونٹی کے ساتھ مل کر اوپن سیفٹی ٹولنگ کو بہتر بنانے کے لیے مسلسل کام کرتے رہیں گے. RMC حفاظتی ماہرین اور محققین کو اکٹھا کرتا ہے تاکہ اوپن سورس AI ماڈلز کو حفاظتی ورک فلوز میں نافذ کرنے کے بہترین طریقے شیئر کیے جا سکیں، بشمول تشخیصی نتائج اور ماڈل فیڈ بیک. اس شراکت داری کے بارے میں مزید جاننے اور شامل ہونے کا طریقہ معلوم کرنے کے لیے RMC GitHub ریپو دیکھیں.
سپورٹ اور کمیونٹی
اوپن ویٹ تعیناتیاں خود منظم اور خود سروسڈ ہوتی ہیں. سپورٹ حاصل کرنے کے مقامات یہ ہیں:
سوالات، گفتگو، تجاویز: کمیونٹی سے رابطے کے لیے Hugging Face ماڈل صفحات استعمال کریں.
OpenAI کے ریفرنس انفیرنس کوڈ میں دوبارہ پیدا ہونے والے بگز: gpt-oss GitHub ریپو پر ایک ایشو کھولیں.
تھرڈ پارٹی رن ٹائم کے مسائل (مثلاً vLLM، Ollama، llama.cpp): متعلقہ پروجیکٹ کا ایشو ٹریکر، فورمز، یا سپورٹ عمل استعمال کریں.
OpenAI کسی بھی سیلف ہوسٹڈ یا تھرڈ پارٹی ہوسٹڈ اوپن ویٹ سیٹ اپس، کنفیگریشنز، ماحولیات، یا ایپلیکیشنز کے لیے مدد، عملی نفاذ، یا ڈیبگنگ سپورٹ فراہم نہیں کرتا.
رازداری اور حفاظت
رازداری اور ڈیٹا
یہ ماڈلز آپ کے زیرِ کنٹرول انفراسٹرکچر پر چلنے کے لیے بنائے گئے ہیں (آن پریمسز یا آپ کے کلاؤڈ یا ہوسٹنگ پارٹنر میں). OpenAI ان سیلف ہوسٹڈ ماڈلز کو بھیجے گئے آپ کے ڈیٹا کو وصول یا پروسیس نہیں کرتا، الا یہ کہ آپ اسے واضح طور پر OpenAI کے ساتھ شیئر کریں، یا ہمارے کسی منیجڈ ہوسٹنگ پارٹنر کو استعمال کریں.
حفاظت
ان ماڈلز پر وسیع حفاظتی تربیت اور جانچ کی گئی. مزید تفصیلات کے لیے ہمارا ماڈل کارڈ اور تکنیکی رپورٹ دیکھیں.
مواد کی خلاف ورزیوں کی رپورٹنگ
اگر آپ کو لگتا ہے کہ gpt‑oss ماڈلز سے تیار کردہ مواد ہماری پالیسیوں کی خلاف ورزی کرتا ہے، تو آپ اسے ہمارے Report Content فارم کے ذریعے رپورٹ کر سکتے ہیں. براہِ کرم ہماری ٹیم کو آپ کی جمع کرائی گئی معلومات کا جائزہ لینے میں مدد کے لیے زیادہ سے زیادہ تفصیل فراہم کریں.
اکثر پوچھے جانے والے سوالات
کیا یہ ماڈلز مفت ہیں؟
gpt-oss ماڈل ویٹس Apache 2.0 لائسنس اور gpt-oss استعمال پالیسی کے تحت ڈاؤن لوڈ اور استعمال کے لیے مفت ہیں. تاہم، انہیں چلانے سے وابستہ کسی بھی لاگت—جیسے کمپیوٹ، اسٹوریج، یا تھرڈ پارٹی ہوسٹنگ فیس—کی ذمہ داری آپ کی ہے. ان کی قیمت آپ کے منتخب کردہ انفراسٹرکچر یا فراہم کنندہ پر منحصر ہوگی.
کیا یہ ماڈلز “اوپن سورس” ہیں؟
ہم اوپن ماڈلز یا اوپن ویٹ کی اصطلاح استعمال کرتے ہیں تاکہ بتایا جا سکے کہ تربیت یافتہ ویٹس اجازت دینے والے Apache 2.0 لائسنس اور gpt-oss استعمال پالیسی کے تحت عوامی طور پر دستیاب ہیں. اس کا مطلب ہے کہ آپ ماڈلز ڈاؤن لوڈ کر سکتے ہیں، انہیں اپنے انفراسٹرکچر یا معاون ہوسٹنگ فریم ورکس کے ساتھ چلا سکتے ہیں، اور انہیں کسٹمائز یا فائن ٹیون کر سکتے ہیں.
اوپن ماڈلز ڈویلپرز اور تنظیموں کو زیادہ کنٹرول اور لچک دیتے ہیں. آپ انتخاب کر سکتے ہیں کہ ہوسٹنگ کہاں ہو، ماڈلز کو مخصوص استعمالات کے لیے ڈھال سکتے ہیں، اور ایسے لائسنسنگ سے فائدہ اٹھا سکتے ہیں جو وسیع استعمال، ترمیم، اور دوبارہ تقسیم کی اجازت دیتی ہے. اگرچہ تربیت یافتہ ویٹس اوپن ہیں، کچھ متعلقہ انفراسٹرکچر یا ٹولنگ اپنے فراہم کنندگان کی ملکیت رہ سکتی ہے.
کیا میں ان ماڈلز تک OpenAI API یا ChatGPT کے ذریعے رسائی حاصل کر سکتا ہوں؟
نہیں. یہ ماڈلز OpenAI API میں سرو نہیں کیے جاتے اور ChatGPT میں ظاہر نہیں ہوتے.
کیا میں ماڈلز کو فائن ٹیون کر سکتا ہوں؟
ہاں. آپ اوپن سورس ٹولز اور اپنے پسندیدہ انفراسٹرکچر کے ذریعے فائن ٹیون کر سکتے ہیں. ہم ان ماڈلز کے لیے OpenAI APIs کے ذریعے فائن ٹیوننگ پیش نہیں کرتے.
کیا اوپن ویٹ ماڈلز API استعمال کرنے سے سستے ہیں؟
لاگت انفراسٹرکچر، ورک لوڈ، اور آپریشنل طریقۂ کار کے مطابق بدلتی ہے. کچھ صورتوں میں سیلف ہوسٹنگ سستی ہو سکتی ہے، جبکہ ہوسٹنگ، دیکھ بھال، اور اپ گریڈز کو شامل کرنے پر ہماری API Platform زیادہ مؤثر ہو سکتی ہے.
یہ ماڈلز کن فیچرز کو سپورٹ کرتے ہیں؟
یہ ماڈلز فی الحال صرف متن والے ریزننگ ماڈلز ہیں. عام رن ٹائمز اسٹریمنگ، فنکشن کالنگ، اور اسٹرکچرڈ آؤٹ پٹس کو سپورٹ کرتے ہیں. درست صلاحیتوں کے لیے اپنے رن ٹائم کی دستاویزات دیکھیں.
یہ ModAPI سے کیسے مختلف ہے؟
یہ ایک انتہائی قابل ریزننگ ماڈل ہے جو آپ کو اپنی پالیسی لانے کی اجازت دیتا ہے. یہ ModAPI کے ساتھ مل کر کام کر سکتا ہے، مگر کم تاخیر والے استعمالات کا متبادل غالباً نہیں ہے.
