OpenAI
Ukurasa huu ulitafsiriwa na mashine. Tazama makala asili ya Kiingereza.

Kudhibiti urefu wa majibu ya miundo ya OpenAI

Jifunze kuweka vikomo vya matokeo kwa miundo ya OpenAI ukitumia mipangilio ya tokeni, madokezo wazi, mifano na mfuatano wa kusimamisha.

Ilisasishwa: 14 days ago

Muhtasari

Kudhibiti urefu wa jibu la muundo ni muhimu kwa sababu kadhaa: husaidia kudhibiti gharama (kwa kuwa unalipa kwa kila tokeni), huboresha uchelewaji/utendakazi (majibu mafupi hurejeshwa haraka), na huhakikisha ufaafu kwa kuepuka matokeo marefu kupita kiasi au yenye maneno mengi.

Unaweza kufanya hivyo kwa kutumia vikomo vya tokeni, mipangilio ya uwazaji na kiwango cha maelezo, maagizo yaliyo wazi, mifano, na mifuatano ya kusitisha. Kwa maelezo ya sasa na kamili zaidi, rejelea kila wakati rejeleo rasmi la API kwenye platform.openai.com.

Weka urefu wa juu wa matokeo

API ya Responses

Hutumiwa kwa miundo ya GPT-5 na miundo mingi ya o-series: tumia max_output_tokens kuwekea kikomo idadi ya tokeni ambazo muundo utazalisha. Kwa maombi ya compaction_trigger, ama acha kujumuisha max_output_tokens au uiweke angalau 20000; thamani ndogo zaidi hukataliwa. API ya Responses haitumii majibu mengi (n).

API ya Majibu ya Mazungumzo

Hutumiwa kwa GPT-3.5 ya zamani, GPT-4o, na wakati mwingine o-series.

  • Kwa miundo ya uwazaji kama o3 na o4-mini, tumia max_completion_tokens (jina mbadala la max_tokens)

  • Kwa miundo ya awali/isiyo ya uwazaji, max_tokens bado hufanya kazi

  • Inaauni stop na n (majibu mengi).

Kumbuka: Hakuna mpangilio wa “tokeni za chini kabisa”. Ikiwa unahitaji urefu wa chini, eleza hilo katika dokeza lako.

Vikomo vya tokeni kwa vikundi vya miundo

Kwa vikomo vya tokeni, ukubwa wa muktadha na vikomo vya matokeo vilivyo sasa, tafadhali rejelea nyaraka za muundo mahususi.

Mifano ya haraka

API ya Responses

{ "model": "gpt-5", "input": "Fupisha matokeo kwa takriban maneno 80.", "max_output_tokens": 120 }

Majibu ya Mazungumzo (muundo wa uwazaji)

{ "model": "o3-mini", "messages": [{"role": "user", "content": "Write five one-line options."}], "max_completion_tokens": 100 }

Vidhibiti mahususi vya miundo ya GPT-5: verbosity na reasoning.effort

Vidhibiti hivi vinapatikana tu kwenye miundo ya GPT-5 (gpt-5.2, gpt-5.2-chat-latest, gpt-5.2 pro, n.k.). Miundo ya O-series na miundo ya zamani haiiauni.

`verbosity` hukubali "low", "medium" (chaguo-msingi), au "high". Huathiri kiwango cha maelezo, si vikomo madhubuti.

{ "model": "gpt-5", "input": "Eleza PageRank kwa kiwango cha jumla.", "text": { "verbosity": "low" }, "max_output_tokens": 200 }

`reasoning.effort` hudhibiti idadi ya tokeni za uwazaji zinazozalishwa kabla ya kutoa jibu. GPT-5.2 inaauni none,low, medium, high,and xhigh. gpt-5.2-pro inaauni tu medium, high,and xhigh. Miundo ya awali ya uwazaji inaauni tu low, medium, na high.

{ "model": "gpt-5", "input": "Itachukua dhahabu kiasi gani kufunika Sanamu ya Uhuru kwa tabaka la 1mm?", "reasoning": { "effort": "minimal" } }

Unaweza kuweka `reasoning.effort` kuwa none ili muundo utende kama muundo usio wa uwazaji kwa matumizi yanayohitaji uchelewaji mdogo.

Toa maagizo mahususi

Omba urefu au mpangilio halisi unaotaka. Mifano:

  • “Orodhesha chaguo tano haswa.”

  • “Andika muhtasari wa maneno 50.”

  • “Si zaidi ya tokeni 100. Ikiwa unahitaji nafasi zaidi, sema ‘Nahitaji nafasi zaidi.’”

Tumia mifano yenye urefu thabiti

Mifano ya sampuli-chache inayolingana na urefu unaotaka husaidia muundo kuendeleza mtindo huo.

Tumia mifuatano ya kusitisha kimkakati

Tumia stop kusitisha uzalishaji muundo unapofikia kitenganishi au mpaka wa orodha yenye nambari.

{ "stop": ["
###", "6."] }

Chaguo kadhaa

  • Majibu ya Mazungumzo: n hurejesha majibu mengi katika mwito mmoja.

  • API ya Responses: n haiuniwi; fanya miito kadhaa ikiwa unahitaji zaidi ya tokeo moja.

Je, makala haya yamekusaidia?