OpenAI
Šo lapu tulkoja mašīntulks. Skatīt oriģinālo rakstu angļu valodā.

OpenAI modeļu atbilžu garuma kontrole

Uzziniet, kā OpenAI modeļiem iestatīt izvades ierobežojumus, izmantojot tekstvienību iestatījumus, skaidras uzvednes, piemērus un apturēšanas secības.

Atjaunināts: 8 days ago

Pārskats

Modeļa atbildes garuma kontrolēšana ir noderīga vairāku iemeslu dēļ: tā palīdz pārvaldīt izmaksas (jo maksājat par katru tekstvienību), uzlabo latentumu/veiktspēju (īsākas atbildes tiek atgrieztas ātrāk) un nodrošina atbilstību, izvairoties no pārmērīgi garām vai izplūdušām atbildēm.

To var panākt ar tekstvienību limitiem, spriestspējas un detalizācijas iestatījumiem, skaidriem norādījumiem, piemēriem un apturēšanas secībām. Lai iegūtu visaktuālāko un pilnīgāko informāciju, vienmēr skatiet oficiālo API atsauci vietnē platform.openai.com.

Iestatiet maksimālo izvades garumu

Responses API

Izmanto GPT-5 modeļiem un lielākajai daļai o sērijas modeļu: izmantojiet max_output_tokens, lai ierobežotu modelim ģenerējamo tekstvienību skaitu. compaction_trigger pieprasījumiem vai nu izlaidiet max_output_tokens, vai iestatiet to vismaz uz 20000; mazākas vērtības tiek noraidītas. Responses API neatbalsta vairākas pabeigšanas (n).

Tērzēšanas pabeigšanas API

Izmanto mantotajiem GPT-3.5, GPT-4o un dažkārt o sērijas modeļiem.

  • Spriestspējas modeļiem, piemēram, o3 un o4-mini, izmantojiet max_completion_tokens (max_tokens aizstājvārds).

  • Agrākiem modeļiem vai modeļiem bez spriestspējas joprojām darbojas max_tokens.

  • Atbalsta stop un n (vairākas pabeigšanas).

Piezīme: Nav “minimālā tekstvienību skaita” iestatījuma. Ja jums vajag minimālu garumu, norādiet to savā uzvednē.

Tekstvienību ierobežojumi pēc modeļu grupas

Aktuālos tekstvienību ierobežojumus, konteksta izmērus un izvades limitus skatiet konkrētā modeļa dokumentācijā.

Īsi piemēri

Responses API

{ "model": "gpt-5", "input": "Apkopojiet secinājumus ~80 vārdos.", "max_output_tokens": 120 }

Tērzēšanas pabeigšana (spriestspējas modelis)

{ "model": "o3-mini", "messages": [{"role": "user", "content": "Write five one-line options."}], "max_completion_tokens": 100 }

GPT-5 modeļiem specifiskas vadīklas: verbosity un reasoning.effort

Šīs vadīklas ir pieejamas tikai GPT-5 modeļos (gpt-5.2, gpt-5.2-chat-latest, gpt-5.2 pro utt.). O sērijas un mantotie modeļi tās neatbalsta.

`verbosity` pieņem "low", "medium" (noklusējums) vai "high". Tas ietekmē detalizācijas līmeni, bet ne stingros ierobežojumus.

{ "model": "gpt-5", "input": "Izskaidrojiet PageRank vispārīgā līmenī.", "text": { "verbosity": "low" }, "max_output_tokens": 200 }

`reasoning.effort` nosaka, cik spriestspējas tekstvienību tiek ģenerēts pirms atbildes sniegšanas. GPT-5.2 atbalsta none,low, medium, high,and xhigh. gpt-5.2-pro atbalsta tikai medium, high,and xhigh. Agrākie spriestspējas modeļi atbalsta tikai low, medium un high.

{ "model": "gpt-5", "input": "Cik daudz zelta būtu vajadzīgs, lai Brīvības statuju pārklātu ar 1 mm slāni?", "reasoning": { "effort": "minimal" } }

Varat iestatīt `reasoning.effort` uz none, lai modelis latentumjutīgos lietojumos darbotos kā modelis bez spriestspējas.

Sniedziet konkrētus norādījumus

Norādiet precīzu vēlamo garumu vai formu. Piemēri:

  • „Uzskaiti tieši piecas iespējas.”

  • „Uzraksti 50 vārdu kopsavilkumu.”

  • „Ne vairāk kā 100 tekstvienību. Ja nepieciešams vairāk, saki: ‘Vajag vairāk vietas.’”

Izmantojiet piemērus ar konsekventu garumu

Dažpiemēru piemēri, kas atbilst vēlamajam garumam, palīdz modelim turpināt paraugu.

Izmantojiet stratēģiskas apturēšanas secības

Izmantojiet stop, lai apturētu ģenerēšanu, kad modelis sasniedz atdalītāju vai numurēta saraksta robežu.

{ "stop": ["
###", "6."] }

Vairāki kandidāti

  • Tērzēšanas pabeigšana: n atgriež vairākas pabeigšanas vienā izsaukumā.

  • Responses API: n netiek atbalstīts; veiciet vairākus izsaukumus, ja nepieciešama vairāk nekā viena izvade.

Vai šis raksts bija noderīgs?