OpenAI
Ukurasa huu ulitafsiriwa na mashine. Tazama makala asili ya Kiingereza.

Kudhibiti urefu wa majibu ya miundo ya OpenAI

Jifunze kuweka vikomo vya matokeo kwa miundo ya OpenAI ukitumia mipangilio ya tokeni, madokezo wazi, mifano na mfuatano wa kusimamisha.

Ilisasishwa: 18 days ago

Muhtasari

Kudhibiti urefu wa jibu la muundo ni muhimu kwa sababu kadhaa: husaidia kudhibiti gharama (kwa kuwa unalipa kwa kila tokeni), huboresha uchelewaji/utendakazi (majibu mafupi hurejeshwa haraka), na huhakikisha ufaafu kwa kuepuka matokeo marefu kupita kiasi au yenye maneno mengi.

Unaweza kufanya hivyo kwa kutumia vikomo vya tokeni, mipangilio ya uwazaji na kiwango cha maelezo, maagizo yaliyo wazi, mifano, na mifuatano ya kusitisha. Kwa maelezo ya sasa na kamili zaidi, rejelea kila wakati rejeleo rasmi la API kwenye platform.openai.com.

Weka urefu wa juu wa matokeo

API ya Majibu

Hutumika kwa miundo ya GPT-5 na miundo mingi ya mfululizo wa o: tumia max_output_tokens kuweka kikomo cha tokeni ambazo muundo utazalisha. Kwa maombi ya compaction_trigger, usiweke max_output_tokens au uiweke angalau 20000; thamani ndogo zaidi hukataliwa. API ya Majibu haitumii majibu mengi kwa ombi moja (n).

API ya Majibu ya Mazungumzo

Hutumika kwa GPT-3.5 na GPT-4o za zamani, na wakati mwingine kwa mfululizo wa o.

  • Kwa miundo ya uwazaji kama o3 na o4-mini, tumia max_completion_tokens (jina mbadala la max_tokens)

  • Kwa miundo ya awali au isiyo ya uwazaji, max_tokens bado hufanya kazi

  • Hutumia stop na n (majibu mengi kwa ombi moja).

Kumbuka: Hakuna mpangilio wa “tokeni za chini kabisa”. Ikiwa unahitaji urefu wa chini, eleza hilo katika dokeza lako.

Vikomo vya tokeni kwa vikundi vya miundo

Kwa vikomo vya tokeni, ukubwa wa muktadha na vikomo vya matokeo vilivyo sasa, tafadhali rejelea nyaraka za muundo mahususi.

Mifano ya haraka

API ya Responses

{ "model": "gpt-5", "input": "Fupisha matokeo kwa takriban maneno 80.", "max_output_tokens": 120 }

Majibu ya Mazungumzo (muundo wa uwazaji)

{ "model": "o3-mini", "messages": [{"role": "user", "content": "Write five one-line options."}], "max_completion_tokens": 100 }

Vidhibiti mahususi vya miundo ya GPT-5: verbosity na reasoning.effort

Vidhibiti hivi vinapatikana tu kwenye miundo ya GPT-5 (gpt-5.2, gpt-5.2-chat-latest, gpt-5.2 pro, n.k.). Miundo ya mfululizo wa O na miundo ya zamani haivitumii.


verbosity hukubali "low", "medium" (chaguomsingi), au "high". Huathiri kiwango cha maelezo, lakini si vikomo thabiti.

{ "model": "gpt-5", "input": "Eleza PageRank kwa kiwango cha jumla.", "text": { "verbosity": "low" }, "max_output_tokens": 200 }

reasoning.effort hudhibiti idadi ya tokeni za uwazaji zinazozalishwa kabla ya kutoa jibu. GPT-5.2 hutumia none, low, medium, high na xhigh. gpt-5.2-pro hutumia tu medium, high na xhigh. Miundo ya awali ya uwazaji hutumia tu low, medium na high.

{ "model": "gpt-5", "input": "Itachukua dhahabu kiasi gani kufunika Sanamu ya Uhuru kwa tabaka la 1mm?", "reasoning": { "effort": "minimal" } }

Unaweza kuweka reasoning.effort kuwa none ili muundo ufanye kazi kama muundo usio wa uwazaji katika hali zinazohitaji muda mfupi wa kusubiri.

Toa maagizo mahususi

Omba urefu au mpangilio halisi unaotaka. Mifano:

  • “Orodhesha chaguo tano haswa.”

  • “Andika muhtasari wa maneno 50.”

  • “Si zaidi ya tokeni 100. Ikiwa unahitaji nafasi zaidi, sema ‘Nahitaji nafasi zaidi.’”

Tumia mifano yenye urefu thabiti

Mifano ya sampuli-chache inayolingana na urefu unaotaka husaidia muundo kuendeleza mtindo huo.

Tumia mifuatano ya kusimamisha kimkakati

Tumia stop kusitisha uzalishaji muundo unapofikia kitenganishi au mwisho wa orodha yenye nambari.

{ "stop": ["
###", "6."] }

Majibu mbadala mengi

  • API ya Majibu ya Mazungumzo: n hurejesha majibu mengi kwa mwito mmoja.

  • API ya Majibu: n haitumiki; piga miito kadhaa ikiwa unahitaji zaidi ya tokeo moja.

Je, makala haya yamekusaidia?