Pārskats
Modeļa atbildes garuma kontrolēšana ir noderīga vairāku iemeslu dēļ: tā palīdz pārvaldīt izmaksas (jo maksājat par katru tekstvienību), uzlabo latentumu/veiktspēju (īsākas atbildes tiek atgrieztas ātrāk) un nodrošina atbilstību, izvairoties no pārmērīgi garām vai izplūdušām atbildēm.
To var panākt ar tekstvienību limitiem, spriestspējas un detalizācijas iestatījumiem, skaidriem norādījumiem, piemēriem un apturēšanas secībām. Lai iegūtu visaktuālāko un pilnīgāko informāciju, vienmēr skatiet oficiālo API atsauci vietnē platform.openai.com.
Iestatiet maksimālo izvades garumu
Responses API
Izmanto GPT-5 modeļiem un lielākajai daļai o sērijas modeļu: izmantojiet max_output_tokens, lai ierobežotu modelim ģenerējamo tekstvienību skaitu. compaction_trigger pieprasījumiem vai nu izlaidiet max_output_tokens, vai iestatiet to vismaz uz 20000; mazākas vērtības tiek noraidītas. Responses API neatbalsta vairākas pabeigšanas (n).
Tērzēšanas pabeigšanas API
Izmanto mantotajiem GPT-3.5, GPT-4o un dažkārt o sērijas modeļiem.
Spriestspējas modeļiem, piemēram, o3 un o4-mini, izmantojiet
max_completion_tokens(max_tokensaizstājvārds).Agrākiem modeļiem vai modeļiem bez spriestspējas joprojām darbojas
max_tokens.Atbalsta
stopunn(vairākas pabeigšanas).
Piezīme: Nav “minimālā tekstvienību skaita” iestatījuma. Ja jums vajag minimālu garumu, norādiet to savā uzvednē.
Tekstvienību ierobežojumi pēc modeļu grupas
Aktuālos tekstvienību ierobežojumus, konteksta izmērus un izvades limitus skatiet konkrētā modeļa dokumentācijā.
Īsi piemēri
Responses API
{ "model": "gpt-5", "input": "Apkopojiet secinājumus ~80 vārdos.", "max_output_tokens": 120 }Tērzēšanas pabeigšana (spriestspējas modelis)
{ "model": "o3-mini", "messages": [{"role": "user", "content": "Write five one-line options."}], "max_completion_tokens": 100 }GPT-5 modeļiem specifiskas vadīklas: verbosity un reasoning.effort
Šīs vadīklas ir pieejamas tikai GPT-5 modeļos (gpt-5.2, gpt-5.2-chat-latest, gpt-5.2 pro utt.). O sērijas un mantotie modeļi tās neatbalsta.
`verbosity` pieņem "low", "medium" (noklusējums) vai "high". Tas ietekmē detalizācijas līmeni, bet ne stingros ierobežojumus.
{ "model": "gpt-5", "input": "Izskaidrojiet PageRank vispārīgā līmenī.", "text": { "verbosity": "low" }, "max_output_tokens": 200 }`reasoning.effort` nosaka, cik spriestspējas tekstvienību tiek ģenerēts pirms atbildes sniegšanas. GPT-5.2 atbalsta none,low, medium, high,and xhigh. gpt-5.2-pro atbalsta tikai medium, high,and xhigh. Agrākie spriestspējas modeļi atbalsta tikai low, medium un high.
{ "model": "gpt-5", "input": "Cik daudz zelta būtu vajadzīgs, lai Brīvības statuju pārklātu ar 1 mm slāni?", "reasoning": { "effort": "minimal" } }Varat iestatīt `reasoning.effort` uz none, lai modelis latentumjutīgos lietojumos darbotos kā modelis bez spriestspējas.
Sniedziet konkrētus norādījumus
Norādiet precīzu vēlamo garumu vai formu. Piemēri:
„Uzskaiti tieši piecas iespējas.”
„Uzraksti 50 vārdu kopsavilkumu.”
„Ne vairāk kā 100 tekstvienību. Ja nepieciešams vairāk, saki: ‘Vajag vairāk vietas.’”
Izmantojiet piemērus ar konsekventu garumu
Dažpiemēru piemēri, kas atbilst vēlamajam garumam, palīdz modelim turpināt paraugu.
Izmantojiet stratēģiskas apturēšanas secības
Izmantojiet stop, lai apturētu ģenerēšanu, kad modelis sasniedz atdalītāju vai numurēta saraksta robežu.
{ "stop": ["
###", "6."] }Vairāki kandidāti
Tērzēšanas pabeigšana:
natgriež vairākas pabeigšanas vienā izsaukumā.Responses API:
nnetiek atbalstīts; veiciet vairākus izsaukumus, ja nepieciešama vairāk nekā viena izvade.
