Muhtasari
Kudhibiti urefu wa jibu la muundo ni muhimu kwa sababu kadhaa: husaidia kudhibiti gharama (kwa kuwa unalipa kwa kila tokeni), huboresha uchelewaji/utendakazi (majibu mafupi hurejeshwa haraka), na huhakikisha ufaafu kwa kuepuka matokeo marefu kupita kiasi au yenye maneno mengi.
Unaweza kufanya hivyo kwa kutumia vikomo vya tokeni, mipangilio ya uwazaji na kiwango cha maelezo, maagizo yaliyo wazi, mifano, na mifuatano ya kusitisha. Kwa maelezo ya sasa na kamili zaidi, rejelea kila wakati rejeleo rasmi la API kwenye platform.openai.com.
Weka urefu wa juu wa matokeo
API ya Responses
Hutumiwa kwa miundo ya GPT-5 na miundo mingi ya o-series: tumia max_output_tokens kuwekea kikomo idadi ya tokeni ambazo muundo utazalisha. Kwa maombi ya compaction_trigger, ama acha kujumuisha max_output_tokens au uiweke angalau 20000; thamani ndogo zaidi hukataliwa. API ya Responses haitumii majibu mengi (n).
API ya Majibu ya Mazungumzo
Hutumiwa kwa GPT-3.5 ya zamani, GPT-4o, na wakati mwingine o-series.
Kwa miundo ya uwazaji kama o3 na o4-mini, tumia
max_completion_tokens(jina mbadala lamax_tokens)Kwa miundo ya awali/isiyo ya uwazaji,
max_tokensbado hufanya kaziInaauni
stopnan(majibu mengi).
Kumbuka: Hakuna mpangilio wa “tokeni za chini kabisa”. Ikiwa unahitaji urefu wa chini, eleza hilo katika dokeza lako.
Vikomo vya tokeni kwa vikundi vya miundo
Kwa vikomo vya tokeni, ukubwa wa muktadha na vikomo vya matokeo vilivyo sasa, tafadhali rejelea nyaraka za muundo mahususi.
Mifano ya haraka
API ya Responses
{ "model": "gpt-5", "input": "Fupisha matokeo kwa takriban maneno 80.", "max_output_tokens": 120 }Majibu ya Mazungumzo (muundo wa uwazaji)
{ "model": "o3-mini", "messages": [{"role": "user", "content": "Write five one-line options."}], "max_completion_tokens": 100 }Vidhibiti mahususi vya miundo ya GPT-5: verbosity na reasoning.effort
Vidhibiti hivi vinapatikana tu kwenye miundo ya GPT-5 (gpt-5.2, gpt-5.2-chat-latest, gpt-5.2 pro, n.k.). Miundo ya O-series na miundo ya zamani haiiauni.
`verbosity` hukubali "low", "medium" (chaguo-msingi), au "high". Huathiri kiwango cha maelezo, si vikomo madhubuti.
{ "model": "gpt-5", "input": "Eleza PageRank kwa kiwango cha jumla.", "text": { "verbosity": "low" }, "max_output_tokens": 200 }`reasoning.effort` hudhibiti idadi ya tokeni za uwazaji zinazozalishwa kabla ya kutoa jibu. GPT-5.2 inaauni none,low, medium, high,and xhigh. gpt-5.2-pro inaauni tu medium, high,and xhigh. Miundo ya awali ya uwazaji inaauni tu low, medium, na high.
{ "model": "gpt-5", "input": "Itachukua dhahabu kiasi gani kufunika Sanamu ya Uhuru kwa tabaka la 1mm?", "reasoning": { "effort": "minimal" } }Unaweza kuweka `reasoning.effort` kuwa none ili muundo utende kama muundo usio wa uwazaji kwa matumizi yanayohitaji uchelewaji mdogo.
Toa maagizo mahususi
Omba urefu au mpangilio halisi unaotaka. Mifano:
“Orodhesha chaguo tano haswa.”
“Andika muhtasari wa maneno 50.”
“Si zaidi ya tokeni 100. Ikiwa unahitaji nafasi zaidi, sema ‘Nahitaji nafasi zaidi.’”
Tumia mifano yenye urefu thabiti
Mifano ya sampuli-chache inayolingana na urefu unaotaka husaidia muundo kuendeleza mtindo huo.
Tumia mifuatano ya kusitisha kimkakati
Tumia stop kusitisha uzalishaji muundo unapofikia kitenganishi au mpaka wa orodha yenye nambari.
{ "stop": ["
###", "6."] }Chaguo kadhaa
Majibu ya Mazungumzo:
nhurejesha majibu mengi katika mwito mmoja.API ya Responses:
nhaiuniwi; fanya miito kadhaa ikiwa unahitaji zaidi ya tokeo moja.
