11 مارچ 2025 تک، ہم نے اپنے نئے Agents platform کے building blocks جاری کر دیے ہیں. تفصیلات کے لیے، ہماری Responses API، Web Search، File Search، اور Computer Use سمیت Tools، اور Agents SDK مع Tracing کے لیے ہماری API docs دیکھیں. Assistants API beta کے بارے میں آپ کے feedback کی بنیاد پر، ہم نے اہم improvements کو Responses API میں شامل کیا ہے. جب ہم مکمل feature parity حاصل کر لیں گے، تو اس سال کے آخر میں ہم Assistants API کے deprecation plan کا اعلان کریں گے، جس میں 2026 کی پہلی ششماہی میں target sunset date ہوگی.
Assistants API کیا ہے؟
Assistants API developers کو اپنی apps کے اندر طاقتور AI اسسٹنٹس آسانی سے بنانے کے قابل بناتی ہے. یہ API گفتگو کی history manage کرنے کی ضرورت ختم کرتی ہے اور OpenAI-hosted tools جیسے کوڈ انٹرپریٹر اور File Search تک رسائی شامل کرتی ہے. API تیسری پارٹی tools کے لیے بہتر function calling کو بھی سپورٹ کرتی ہے.
کیا میں اب بھی Assistants API v1 beta استعمال کر سکتا ہوں؟
نہیں. 18 دسمبر 2024 سے صارفین کو Assistant API beta کے v1 ورژن تک رسائی نہیں رہی. ہم فی الحال صرف v2 کو سپورٹ کرتے ہیں. براہ کرم اپنی API calls کو v1 سے v2 میں تبدیل کرنے کے لیے یہ migration guide دیکھیں.
میں اس تک رسائی کیسے حاصل کروں؟
Assistants API ہر اس شخص کے لیے دستیاب ہے جس کے پاس OpenAI API account ہے، لیکن یہ deprecated ہے اور اگست 2026 میں ہٹا دی جائے گی. نئے projects کے لیے اس کے بجائے Responses API استعمال کریں. اگر آپ پہلے ہی Assistants API استعمال کرتے ہیں، تو Responses API پر اپنی migration کی منصوبہ بندی کریں. جب تک API دستیاب ہے، آپ Assistants Playground میں موجودہ اسسٹنٹس تک اب بھی رسائی حاصل کر سکتے ہیں.
اسسٹنٹ کیا ہے؟
اسسٹنٹ ایک مخصوص مقصد کے لیے بنایا گیا AI ہوتا ہے جو OpenAI کے ماڈلز استعمال کرتا ہے اور فائلز تک رسائی حاصل کر سکتا ہے، مستقل تھریڈز برقرار رکھ سکتا ہے، اور ٹولز کو کال کر سکتا ہے.
تھریڈ کیا ہے؟
تھریڈ اسسٹنٹ اور صارف کے درمیان گفتگو کا سیشن ہوتا ہے. تھریڈز میسج ہسٹری محفوظ کر کے اور گفتگو ماڈل کی context length کے لیے بہت لمبی ہو جانے پر اسے مختصر کر کے ایپلیکیشن ڈیولپمنٹ کو آسان بناتے ہیں.
File Search ٹول کیا ہے؟
`file_search` ٹول کئی retrieval best practices کو out of the box implement کرتا ہے تاکہ آپ اپنی files سے درست data نکال کر ماڈل کے responses کو بہتر بنا سکیں. مزید معلومات کے لیے، براہ کرم ہماری developer documentation پڑھیں.
بطور default، file_search ٹول درج ذیل settings استعمال کرتا ہے:
Chunk size: 800 ٹوکنز
Chunk overlap: 400 ٹوکنز
Embedding model: 256 dimensions پر `text-embedding-3-large`
context میں شامل کیے جانے والے chunks کی زیادہ سے زیادہ تعداد: 20
فائل اپ لوڈ کے لیے پابندیاں کیا ہیں؟
فائل اپ لوڈ کرنے کی پابندیاں یہ ہیں:
ہر فائل کے لیے 512 MB
ہر فائل کے لیے 5M ٹوکنز
ہر vector store کے لیے 10k فائلز
ہر اسسٹنٹ کے لیے 1 vector store
ہر تھریڈ کے لیے 1 vector store
کسی تنظیم میں ہر پروجیکٹ کے لیے مجموعی اسٹوریج حد 100 GB ہے.
File Search ٹول کی حدود کیا ہیں؟
ہماری چند معلوم حدود ہیں جن کے لیے ہم آنے والے مہینوں میں سپورٹ شامل کرنے پر کام کر رہے ہیں:
فی الحال chunking، embedding، یا retrieval سیٹنگز میں ترمیم کرنے کا کوئی طریقہ نہیں ہے.
ہم دستاویزات کے اندر تصاویر کی پارسنگ کو سپورٹ نہیں کرتے.
ہم structured file formats (جیسے .csv یا .jsonl فائلز) پر retrievals کو سپورٹ نہیں کرتے. سپورٹڈ فائل ٹائپس دیکھیں.
Assistants API کے لیے ریٹ لمٹس کیا ہیں؟
Assistants API کے ریٹ لمٹس usage tier اور ماڈل سے منسلک نہیں ہیں. اس کے بجائے، request type کے لحاظ سے default limits ہیں، چند exceptions کے ساتھ:
GET: 1000 RPM
POST: 300 RPM
DELETE: فی منٹ 300 درخواستیں
API میں کوڈ انٹرپریٹر کی قیمت کیسے مقرر کی جاتی ہے؟
کوڈ انٹرپریٹر کی قیمت $0.03 / سیشن ہے. اگر آپ کا اسسٹنٹ دو مختلف تھریڈز میں بیک وقت کوڈ انٹرپریٹر کو کال کرتا ہے، تو اس سے کوڈ انٹرپریٹر کے دو سیشن بنیں گے (2 * $0.03). ہر سیشن بطور ڈیفالٹ ایک گھنٹے کے لیے فعال رہتا ہے، جس کا مطلب ہے کہ اگر آپ کا صارف ایک ہی تھریڈ میں ایک گھنٹے تک کوڈ انٹرپریٹر کو ہدایات دیتا رہے تو آپ یہ فیس صرف ایک بار ادا کریں گے.
API میں File Search کی قیمت کیسے مقرر کی جاتی ہے؟
File Search کی قیمت vector store storage کے $0.10/GB فی دن ہے (اسٹوریج کا پہلا GB مفت ہے). vector store کا سائز اس نتیجتی سائز پر مبنی ہوتا ہے جو آپ کی فائل parse، chunk، اور embed ہونے کے بعد vector store کا بنتا ہے.
17 اپریل 2024 سے پہلے بنائے گئے کوئی بھی vector stores 2024 کے آخر تک مفت رہیں گے، جس کے بعد وہ یا تو:
موجودہ rates پر بل کیے جائیں گے (فی الحال $0.10/GB/day) اگر انہیں 17 اپریل 2024 کے بعد بنائے گئے کسی Run میں کم از کم ایک بار استعمال کیا گیا ہو.
حذف کر دیے جائیں گے اگر انہیں 17 اپریل 2024 اور 31 دسمبر 2024 کے درمیان کسی ایک Run میں بھی استعمال نہیں کیا گیا ہو — یہ اس لیے ہے تاکہ آپ کو ان vector stores کے لیے بل نہ ملے جو آپ نے اس pricing change کے اعلان سے پہلے بنائے ہوں مگر کبھی استعمال نہ کیے ہوں.
کیا اس بات کی کوئی حد ہے کہ میں کتنے اسسٹنٹس بنا سکتا ہوں؟
ایک org کتنے اسسٹنٹس بنا سکتی ہے، اس کی کوئی حد نہیں ہے.
کیا API پر streaming دستیاب ہے؟
ہاں، Assistants API پر streaming دستیاب ہے.
کیا JSON موڈ Assistants API میں دستیاب ہے؟
ہاں، JSON موڈ Assistants API پر Assistants یا Run آبجیکٹس میں response_format پیرامیٹر کے ذریعے دستیاب ہے.
کیا Assistants API تیسری پارٹی function calls کی requests بھی manage کرے گی؟
نہیں. اگرچہ function calling ماڈل کو tools منتخب کرنے اور ان کے لیے requests format کرنے کے قابل بناتی ہے، تیسری پارٹی tools کو calls execute کرنا OpenAI کے ذریعے manage نہیں کیا جاتا.
OpenAI کو بھیجے گئے میرے data کے ساتھ کیا کیا جاتا ہے؟
ہمارے platform کے باقی حصوں کی طرح، OpenAI API کو بھیجے گئے data اور files ہمارے ماڈلز کو train کرنے کے لیے کبھی استعمال نہیں کیے جاتے اور آپ جب چاہیں اپنا data حذف کر سکتے ہیں. Assistants API پر upload کیا گیا data اس وقت تک غیر معینہ مدت کے لیے stored رہتا ہے جب تک صارف اسے manually حذف نہ کر دے.
کیا DALL-E Assistants API کے ذریعے دستیاب ہے؟
اس وقت DALL-E دستیاب نہیں ہے.
کیا Assistants API کے لیے کوئی UI ہے؟
آپ Assistants API کے لیے Playground دیکھ سکتے ہیں. یقینی بنائیں کہ آپ بائیں sidebar میں Assistants ویو میں ہیں اور ایسے ماڈل کا استعمال کر رہے ہیں جو ان Tools کے ساتھ compatible ہو جنہیں آپ on کرنا چاہتے ہیں.

Assistants API میں assistant instructions کے لیے character limit کیا ہے؟
assistant instructions field کی زیادہ سے زیادہ length 256,000 characters ہے.
مجھے ایک error مل رہی ہے، جیسے “آپ کی request process کرتے وقت server میں error ہوئی. اس کے لیے معذرت! آپ اپنی request دوبارہ try کر سکتے ہیں، یا اگر error برقرار رہے تو ہمارے help center پر help.openai.com کے ذریعے ہم سے رابطہ کریں. “ مجھے کیا کرنا چاہیے؟
اگر آپ کو یہ error مل رہی ہے، تو اس کا مطلب ہو سکتا ہے کہ آپ کا پرومپٹ درست طور پر set up نہیں کیا گیا. اگر آپ request دوبارہ try کرتے رہتے ہیں اور یہ fail ہوتی ہے، تو یہ چیزیں آزما کر دیکھیں:
یقینی بنائیں کہ آپ اپنے پرومپٹ کو restructure کریں تاکہ function-like commands کو functions کی طرح treat کیا جائے
اپنے پرومپٹ میں موجود کوئی بھی commands بطور function
toolsمیں شامل کریں
میرا File Search ٹول اچھی طرح کام کیوں نہیں کر رہا؟
File Search ٹول استعمال کرتے وقت، ہم max_prompt_tokens کو کم از کم 20,000 پر سیٹ کرنے کی سفارش کرتے ہیں. File Search کے ساتھ طویل گفتگوؤں یا متعدد interactions کے لیے، اس حد کو 50,000 تک بڑھانے پر غور کریں، یا مثالی طور پر، بہترین معیار کے نتائج کے لیے max_prompt_tokens کی حدود کو مکمل طور پر ہٹا دیں. مزید یہاں پڑھیں.
میں feedback کیسے دے سکتا ہوں؟
ہم اپنے Developer Forum پر، ہیلپ سینٹر کے ذریعے help.openai.com پر، یا Twitter پر @OpenAIDevs کے ذریعے آپ کا feedback سننا پسند کریں گے.
