Ħarsa ġenerali
Il-kontroll tat-tul tar-rispons ta’ mudell huwa utli għal diversi raġunijiet: jgħin biex timmaniġġja l-ispiża (għax tħallas għal kull token), itejjeb il-latenza/prestazzjoni (risponsi iqsar jiġu ritornati aktar malajr), u jiżgura r-rilevanza billi jevita outputs twal wisq jew mimlija kliem żejjed.
Tista’ tikseb dan billi tuża limiti massimi tat-tokens, settings tar-raġunament u tal-livell ta’ dettall, struzzjonijiet ċari, eżempji, u sekwenzi ta’ waqfien. Għall-aktar dettalji aġġornati u kompluti, dejjem irreferi għar-referenza uffiċjali tal-API fuq platform.openai.com.
Issettja tul massimu tal-output
API tat-Tweġibiet
Tintuża għall-mudelli GPT-5 u għall-biċċa l-kbira tal-mudelli tas-serje o: uża max_output_tokens biex tillimita l-għadd ta’ tokens li jiġġenera l-mudell. Għat-talbiet compaction_trigger, jew tħalli barra max_output_tokens jew tissettjah għal mill-inqas 20000; valuri iżgħar jiġu miċħuda. L-API tat-Tweġibiet ma tappoġġjax tlestijiet multipli (n).
API tat-tlestija taċ-chats
Tintuża għal GPT-3.5 u GPT-4o preċedenti, u xi drabi għas-serje o.
Għal mudelli tar-raġunament bħal o3 u o4-mini, uża max_completion_tokens (isem alternattiv għal max_tokens)
Għal mudelli preċedenti jew li mhumiex tar-raġunament, max_tokens għadu jaħdem
Tappoġġja stop u n (tlestijiet multipli).
Nota: M'hemmx issettjar ta’ “tokens minimi”. Jekk teħtieġ tul minimu, speċifikah fil-prompt tiegħek.
Limiti tat-tokens skont il-grupp ta’ mudelli
Għal limiti tat-tokens, daqsijiet tal-kuntest, u limiti massimi tal-output aġġornati, jekk jogħġbok ikkonsulta id-dokumentazzjoni speċifika tal-mudell.
Eżempji ta’ malajr
API tar-Risposti
{ "model": "gpt-5", "input": "Agħmel sommarju tas-sejbiet f’madwar 80 kelma.", "max_output_tokens": 120 }Tlestija taċ-Chats (mudell tar-raġunament)
{ "model": "o3-mini", "messages": [{"role": "user", "content": "Write five one-line options."}], "max_completion_tokens": 100 }Kontrolli speċifiċi għall-mudelli GPT-5: verbosity u reasoning.effort
Dawn il-kontrolli huma disponibbli biss fuq il-mudelli GPT-5 (gpt-5.2, gpt-5.2-chat-latest, gpt-5.2 pro, eċċ.). Il-mudelli tas-serje o u l-mudelli preċedenti ma jappoġġjawhomx.
verbosity taċċetta "low", "medium" (default), jew "high". Din taffettwa l-livell ta’ dettall, iżda mhux il-limiti fissi.
{ "model": "gpt-5", "input": "Spjega PageRank f’livell għoli.", "text": { "verbosity": "low" }, "max_output_tokens": 200 }reasoning.effort tikkontrolla kemm jiġu ġġenerati tokens tar-raġunament qabel ma tingħata tweġiba. GPT-5.2 jappoġġja none, low, medium, high u xhigh. gpt-5.2-pro jappoġġja biss medium, high u xhigh. Mudelli tar-raġunament preċedenti jappoġġjaw biss low, medium u high.
{ "model": "gpt-5", "input": "Kemm ikun hemm bżonn deheb biex tkopri l-Istatwa tal-Libertà b’saff ta’ 1mm?", "reasoning": { "effort": "minimal" } }Tista’ tissettja reasoning.effort għal none biex il-mudell jaħdem bħal mudell mhux tar-raġunament għal każijiet ta’ użu sensittivi għal-latenza.
Agħti struzzjonijiet speċifiċi
Itlob it-tul jew il-format eżatt li trid. Eżempji:
“Elenka eżattament ħames għażliet.”
“Ikteb sommarju ta’ 50 kelma.”
“Mhux aktar minn 100 token. Jekk teħtieġ iktar, għid ‘Għandi bżonn iktar spazju.’”
Uża eżempji b’tul konsistenti
Eżempji few-shot li jaqblu mat-tul mixtieq tiegħek jgħinu lill-mudell ikompli x-xejra.
Applika sekwenzi ta’ waqfien strateġiċi
Uża stop biex twaqqaf il-ġenerazzjoni meta l-mudell jilħaq delimitatur jew it-tmiem ta’ lista nnumerata.
{ "stop": ["
###", "6."] }Kandidati multipli
Tlestijiet taċ-chats: n tirritorna diversi tlestijiet f’sejħa waħda.
API tat-Tweġibiet: n mhijiex appoġġjata; agħmel diversi sejħiet jekk teħtieġ aktar minn output wieħed.
