OpenAI
Kjo faqe u përkthye automatikisht. Shih artikullin origjinal në anglisht.

Pyetje të shpeshta për Assistants API (v2)

Përditësuar: 6 days ago

Që nga 11 marsi 2025, kemi publikuar blloqet ndërtuese të platformës sonë të re të Agjentëve. Për detaje, shihni dokumentet tona API për Responses API, Tools duke përfshirë Web Search, File Search dhe Computer Use, si dhe Agents SDK tonë me Tracing. Bazuar në feedback-un tuaj për Assistants API beta, kemi përfshirë përmirësime kyçe në Responses API. Pasi të arrijmë barazi të plotë të veçorive, do të shpallim një plan për vjetërimin e Assistants API më vonë këtë vit, me datë të synuar ndërprerjeje në gjysmën e parë të 2026.

Çfarë është Assistants API?

Assistants API u mundëson zhvilluesve të ndërtojnë lehtësisht asistentë të fuqishëm AI brenda aplikacioneve të tyre. Kjo API heq nevojën për të menaxhuar historikun e bisedave dhe shton qasje në mjete të hostuara nga OpenAI, si Code Interpreter dhe File Search. API-ja mbështet gjithashtu thirrje funksioni të përmirësuar për mjete të palëve të treta.

A mund ta përdor ende Assistants API v1 beta?

Jo. Që nga 18 dhjetori 2024, përdoruesit nuk kanë më qasje në versionin v1 të Assistant API beta. Aktualisht mbështesim vetëm v2. Ju lutemi shikoni këtë udhëzues migrimi për t’i konvertuar thirrjet tuaja API nga v1 në v2

Si mund të kem qasje në të?

Assistants API është i disponueshëm për këdo me një llogari OpenAI API, por është i vjetëruar dhe do të hiqet në gusht 2026. Për projekte të reja, përdorni në vend të tij Responses API. Nëse tashmë përdorni Assistants API, planifikoni migrimin tuaj te Responses API. Mund të hyni ende te asistentët ekzistues në Assistants Playground ndërsa API-ja mbetet e disponueshme.

Çfarë është një Asistent?

Një asistent përfaqëson një AI të ndërtuar për një qëllim të caktuar, që përdor modelet e OpenAI dhe mund të hyjë në skedarë, të mbajë threads të vazhdueshëm dhe të thërrasë mjete.

Çfarë është një Thread?

Një thread është një sesion bisede midis një asistenti dhe një përdoruesi. Threads thjeshtojnë zhvillimin e aplikacioneve duke ruajtur historikun e mesazheve dhe duke e shkurtuar atë kur biseda bëhet shumë e gjatë për gjatësinë e kontekstit të modelit.

Çfarë është mjeti File Search?

Mjeti `file_search` zbaton disa praktika më të mira të retrieval si parazgjedhje për t’ju ndihmuar të nxirrni të dhënat e duhura nga skedarët tuaj për të përmirësuar përgjigjet e modelit. Për më shumë informacion, ju lutemi lexoni dokumentacionin tonë për zhvillues.

Si parazgjedhje, mjeti file_search përdor cilësimet e mëposhtme:

  • Madhësia e chunk: 800 token

  • Mbivendosja e chunk: 400 token

  • Modeli i embedding: `text-embedding-3-large` me 256 dimensione

  • Numri maksimal i chunks të shtuar në kontekst: 20

Cilat janë kufizimet për ngarkimin e skedarëve?

Kufizimet për ngarkimin e një skedari janë:

  • 512 MB për skedar

  • 5M token për skedar

  • 10k skedarë për vector store

  • 1 vector store për asistent

  • 1 vector store për thread

Kufiri i përgjithshëm i ruajtjes për çdo projekt në një organizatë është 100 GB.

Cilat janë kufizimet e mjetit File Search?

Kemi disa kufizime të njohura për të cilat po punojmë të shtojmë mbështetje në muajt e ardhshëm:

  1. Aktualisht nuk ka mënyrë për të modifikuar cilësimet e chunking, embedding ose retrieval.

  2. Nuk mbështesim analizimin e imazheve brenda dokumenteve.

  3. Nuk mbështesim retrievals mbi formate skedarësh të strukturuar (si skedarët .csv ose .jsonl). Shihni llojet e mbështetura të skedarëve.

Cilat janë kufijtë e normës për Assistants API?

Kufijtë e normës për Assistants API nuk janë të lidhur me nivelin e përdorimit dhe modelin. Në vend të kësaj, ka kufij të parazgjedhur sipas llojit të kërkesës, me disa përjashtime:

  • GET: 1000 RPM

  • POST: 300 RPM

  • DELETE: 300 kërkesa në minutë

Si është çmimi i Code Interpreter në API?

Code Interpreter kushton $0.03 / sesion. Nëse asistenti juaj thërret Code Interpreter njëkohësisht në dy threads të ndryshëm, kjo do të krijonte dy sesione Code Interpreter (2 * $0.03). Çdo sesion është aktiv si parazgjedhje për një orë, që do të thotë se do ta paguanit këtë tarifë vetëm një herë nëse përdoruesi juaj vazhdon t’i japë udhëzime Code Interpreter në të njëjtin thread deri në një orë.

Si është çmimi i File Search në API?

File Search kushton $0.10/GB ruajtje në vector store në ditë (GB-ja e parë e ruajtjes është falas). Madhësia e vector store bazohet në madhësinë përfundimtare të vector store pasi skedari juaj të analizohet, ndahet në chunks dhe embedded.

Çdo vector store që është krijuar para 17 prillit 2024 do të jetë falas deri në fund të vitit 2024, pas së cilës ato ose do të:

  • Faturohen me tarifat aktuale (aktualisht $0.10/GB/ditë) nëse janë përdorur të paktën një herë në një Run të krijuar pas 17 prillit 2024.

  • Fshihen nëse nuk janë përdorur në asnjë Run midis 17 prillit 2024 dhe 31 dhjetorit 2024 — kjo bëhet për të shmangur faturimin për vector stores që mund t’i keni krijuar para se të shpallej ky ndryshim çmimi, por që nuk i keni përdorur kurrë.

A ka kufi për numrin e asistentëve që mund të krijoj?

Nuk ka kufi për numrin e asistentëve që një organizatë mund të krijojë.

A është i disponueshëm streaming në API?

Po, streaming është i disponueshëm në Assistants API.

A është i disponueshëm modaliteti JSON në Assistants API?

Po, modaliteti JSON është i disponueshëm në Assistants API përmes parametrit response_format në objektet Assistants ose Run.

A do të menaxhojë Assistants API edhe kërkesat për thirrje funksioni të palëve të treta?

Jo. Ndërsa thirrja e funksionit i mundëson modelit të zgjedhë mjete dhe të formatojë kërkesat për to, ekzekutimi i thirrjeve drejt mjeteve të palëve të treta nuk menaxhohet nga OpenAI.

Si trajtohen të dhënat që i dërgoj OpenAI?

Ashtu si me pjesën tjetër të platformës sonë, të dhënat dhe skedarët që kalohen te OpenAI API nuk përdoren kurrë për të trajnuar modelet tona dhe mund t’i fshini të dhënat tuaja sa herë që ju nevojitet. Të dhënat e ngarkuara në Assistants API ruhen pafundësisht derisa një përdorues t’i fshijë manualisht.

A është DALL-E i disponueshëm përmes Assistants API?

Për momentin, DALL-E nuk është i disponueshëm.

A ka një UI për Assistants API?

Mund të shikoni Playground për Assistants API. Sigurohuni që jeni në pamjen Assistants në shiritin anësor majtas dhe po përdorni një model të pajtueshëm me Tools që dëshironi të aktivizoni.

Playground Assistants view editing MyQuickstartAssistant with gpt-3.5-turbo and Code interpreter enabled

Cili është kufiri i karaktereve për udhëzimet e asistentit në Assistants API?

Fusha e udhëzimeve të asistentit ka një gjatësi maksimale prej 256,000 karakteresh.

Po marr një gabim si „Serveri pati një gabim gjatë përpunimit të kërkesës suaj. Na vjen keq për këtë! Mund ta riprovoni kërkesën tuaj, ose të na kontaktoni përmes qendrës sonë të ndihmës në help.openai.com nëse gabimi vazhdon. “ Çfarë duhet të bëj?

Nëse po merrni këtë gabim, mund të nënkuptojë se kërkesa juaj nuk është konfiguruar saktë. Nëse vazhdoni ta riprovoni kërkesën dhe ajo dështon, ja disa gjëra për të provuar:

  1. sigurohuni ta ristrukturoni kërkesën tuaj që t’i trajtojë çdo komandë të ngjashme me funksionet si funksione

  2. shtoni çdo komandë në kërkesën tuaj si funksion te tools

Pse mjeti im File Search nuk po funksionon mirë?

Kur përdorni mjetin File Search, rekomandojmë ta vendosni max_prompt_tokens jo më pak se 20,000. Për biseda më të gjata ose ndërveprime të shumta me File Search, merrni parasysh ta rrisni këtë kufi në 50,000, ose idealisht, t’i hiqni fare kufijtë e max_prompt_tokens për të marrë rezultatet më cilësore. Lexoni më shumë këtu.

Si mund të jap feedback?

Do të donim të dëgjonim feedback-un tuaj në Forumin e Zhvilluesve, përmes qendrës së ndihmës në help.openai.com, ose në Twitter @OpenAIDevs.

A ishte i dobishëm ky artikull?