OpenAI
Din il-paġna ġiet tradotta awtomatikament bl-IA. Ara l-artiklu oriġinali bl-Ingliż.

Ikkontrolla t-tul tar-risposti tal-mudelli ta’ OpenAI

Tgħallem kif tissettja limiti tal-output għal mudelli OpenAI billi tuża tokens, prompts ċari, eżempji u sekwenzi ta’ waqfien.

Aġġornat: last month

Ħarsa ġenerali

Il-kontroll tat-tul tar-rispons ta’ mudell huwa utli għal diversi raġunijiet: jgħin biex timmaniġġja l-ispiża (għax tħallas għal kull token), itejjeb il-latenza/prestazzjoni (risponsi iqsar jiġu ritornati aktar malajr), u jiżgura r-rilevanza billi jevita outputs twal wisq jew mimlija kliem żejjed.

Tista’ tikseb dan billi tuża limiti massimi tat-tokens, settings tar-raġunament u tal-livell ta’ dettall, struzzjonijiet ċari, eżempji, u sekwenzi ta’ waqfien. Għall-aktar dettalji aġġornati u kompluti, dejjem irreferi għar-referenza uffiċjali tal-API fuq platform.openai.com.

Issettja tul massimu tal-output

API tat-Tweġibiet

Tintuża għall-mudelli GPT-5 u għall-biċċa l-kbira tal-mudelli tas-serje o: uża max_output_tokens biex tillimita l-għadd ta’ tokens li jiġġenera l-mudell. Għat-talbiet compaction_trigger, jew tħalli barra max_output_tokens jew tissettjah għal mill-inqas 20000; valuri iżgħar jiġu miċħuda. L-API tat-Tweġibiet ma tappoġġjax tlestijiet multipli (n).

API tat-tlestija taċ-chats

Tintuża għal GPT-3.5 u GPT-4o preċedenti, u xi drabi għas-serje o.

  • Għal mudelli tar-raġunament bħal o3 u o4-mini, uża max_completion_tokens (isem alternattiv għal max_tokens)

  • Għal mudelli preċedenti jew li mhumiex tar-raġunament, max_tokens għadu jaħdem

  • Tappoġġja stop u n (tlestijiet multipli).

Nota: M'hemmx issettjar ta’ “tokens minimi”. Jekk teħtieġ tul minimu, speċifikah fil-prompt tiegħek.

Limiti tat-tokens skont il-grupp ta’ mudelli

Għal limiti tat-tokens, daqsijiet tal-kuntest, u limiti massimi tal-output aġġornati, jekk jogħġbok ikkonsulta id-dokumentazzjoni speċifika tal-mudell.

Eżempji ta’ malajr

API tar-Risposti

{ "model": "gpt-5", "input": "Agħmel sommarju tas-sejbiet f’madwar 80 kelma.", "max_output_tokens": 120 }

Tlestija taċ-Chats (mudell tar-raġunament)

{ "model": "o3-mini", "messages": [{"role": "user", "content": "Write five one-line options."}], "max_completion_tokens": 100 }

Kontrolli speċifiċi għall-mudelli GPT-5: verbosity u reasoning.effort

Dawn il-kontrolli huma disponibbli biss fuq il-mudelli GPT-5 (gpt-5.2, gpt-5.2-chat-latest, gpt-5.2 pro, eċċ.). Il-mudelli tas-serje o u l-mudelli preċedenti ma jappoġġjawhomx.


verbosity taċċetta "low", "medium" (default), jew "high". Din taffettwa l-livell ta’ dettall, iżda mhux il-limiti fissi.

{ "model": "gpt-5", "input": "Spjega PageRank f’livell għoli.", "text": { "verbosity": "low" }, "max_output_tokens": 200 }

reasoning.effort tikkontrolla kemm jiġu ġġenerati tokens tar-raġunament qabel ma tingħata tweġiba. GPT-5.2 jappoġġja none, low, medium, high u xhigh. gpt-5.2-pro jappoġġja biss medium, high u xhigh. Mudelli tar-raġunament preċedenti jappoġġjaw biss low, medium u high.

{ "model": "gpt-5", "input": "Kemm ikun hemm bżonn deheb biex tkopri l-Istatwa tal-Libertà b’saff ta’ 1mm?", "reasoning": { "effort": "minimal" } }

Tista’ tissettja reasoning.effort għal none biex il-mudell jaħdem bħal mudell mhux tar-raġunament għal każijiet ta’ użu sensittivi għal-latenza.

Agħti struzzjonijiet speċifiċi

Itlob it-tul jew il-format eżatt li trid. Eżempji:

  • “Elenka eżattament ħames għażliet.”

  • “Ikteb sommarju ta’ 50 kelma.”

  • “Mhux aktar minn 100 token. Jekk teħtieġ iktar, għid ‘Għandi bżonn iktar spazju.’”

Uża eżempji b’tul konsistenti

Eżempji few-shot li jaqblu mat-tul mixtieq tiegħek jgħinu lill-mudell ikompli x-xejra.

Applika sekwenzi ta’ waqfien strateġiċi

Uża stop biex twaqqaf il-ġenerazzjoni meta l-mudell jilħaq delimitatur jew it-tmiem ta’ lista nnumerata.

{ "stop": ["
###", "6."] }

Kandidati multipli

  • Tlestijiet taċ-chats: n tirritorna diversi tlestijiet f’sejħa waħda.

  • API tat-Tweġibiet: n mhijiex appoġġjata; agħmel diversi sejħiet jekk teħtieġ aktar minn output wieħed.

Dan l-artiklu kien ta’ għajnuna?