OpenAI
Šo lapu tulkoja mašīntulks. Skatīt oriģinālo rakstu angļu valodā.

OpenAI modeļu atbilžu garuma kontrole

Uzziniet, kā OpenAI modeļiem iestatīt izvades ierobežojumus, izmantojot tekstvienību iestatījumus, skaidras uzvednes, piemērus un apturēšanas secības.

Atjaunināts: 2 days ago

Pārskats

Modeļa atbildes garuma kontrolēšana ir noderīga vairāku iemeslu dēļ: tā palīdz pārvaldīt izmaksas (jo maksājat par katru tekstvienību), uzlabo latentumu/veiktspēju (īsākas atbildes tiek atgrieztas ātrāk) un nodrošina atbilstību, izvairoties no pārmērīgi garām vai izplūdušām atbildēm.

To var panākt ar tekstvienību limitiem, spriestspējas un detalizācijas iestatījumiem, skaidriem norādījumiem, piemēriem un apturēšanas secībām. Lai iegūtu visaktuālāko un pilnīgāko informāciju, vienmēr skatiet oficiālo API atsauci vietnē platform.openai.com.

Iestatiet maksimālo izvades garumu

Atbilžu API

GPT-5 modeļiem un lielākajai daļai o sērijas modeļu izmantojiet max_output_tokens, lai ierobežotu modeļa ģenerēto tekstvienību skaitu. compaction_trigger pieprasījumos vai nu nenorādiet max_output_tokens, vai iestatiet vismaz 20000; mazākas vērtības tiek noraidītas. Atbilžu API neatbalsta vairākus pabeigšanas rezultātus (n).

Tērzēšanas pabeigšanas API

Izmanto mantotajiem GPT-3.5 un GPT-4o modeļiem, kā arī reizēm o sērijas modeļiem.

  • Tādiem spriestspējas modeļiem kā o3 un o4-mini izmantojiet max_completion_tokens (max_tokens aizstājvārds).

  • Agrākiem modeļiem un modeļiem bez spriestspējas joprojām darbojas max_tokens.

  • Atbalsta stop un n (vairākus pabeigšanas rezultātus).

Piezīme: Nav “minimālā tekstvienību skaita” iestatījuma. Ja jums vajag minimālu garumu, norādiet to savā uzvednē.

Tekstvienību ierobežojumi pēc modeļu grupas

Aktuālos tekstvienību ierobežojumus, konteksta izmērus un izvades limitus skatiet konkrētā modeļa dokumentācijā.

Īsi piemēri

Responses API

{ "model": "gpt-5", "input": "Apkopojiet secinājumus ~80 vārdos.", "max_output_tokens": 120 }

Tērzēšanas pabeigšana (spriestspējas modelis)

{ "model": "o3-mini", "messages": [{"role": "user", "content": "Write five one-line options."}], "max_completion_tokens": 100 }

GPT-5 modeļiem paredzētās vadīklas: verbosity un reasoning.effort

Šīs vadīklas ir pieejamas tikai GPT-5 modeļiem (gpt-5.2, gpt-5.2-chat-latest, gpt-5.2 pro u. c.). O sērijas un mantotie modeļi tās neatbalsta.

Parametrs verbosity pieņem vērtību "low", "medium" (noklusējums) vai "high". Tas ietekmē detalizācijas pakāpi, bet ne stingros ierobežojumus.

{ "model": "gpt-5", "input": "Izskaidrojiet PageRank vispārīgā līmenī.", "text": { "verbosity": "low" }, "max_output_tokens": 200 }

Parametrs reasoning.effort nosaka, cik spriestspējas tekstvienību tiek ģenerēts pirms atbildes izveides. GPT-5.2 atbalsta vērtības none, low, medium, high un xhigh. gpt-5.2-pro atbalsta tikai vērtības medium, high un xhigh. Agrākie spriestspējas modeļi atbalsta tikai vērtības low, medium un high.

{ "model": "gpt-5", "input": "Cik daudz zelta būtu vajadzīgs, lai Brīvības statuju pārklātu ar 1 mm slāni?", "reasoning": { "effort": "minimal" } }

Varat iestatīt parametra reasoning.effort vērtību uz none, lai gadījumos, kad svarīgs mazs latentums, modelis darbotos kā modelis bez spriestspējas.

Sniedziet konkrētus norādījumus

Norādiet precīzu vēlamo garumu vai formu. Piemēri:

  • „Uzskaiti tieši piecas iespējas.”

  • „Uzraksti 50 vārdu kopsavilkumu.”

  • „Ne vairāk kā 100 tekstvienību. Ja nepieciešams vairāk, saki: ‘Vajag vairāk vietas.’”

Izmantojiet piemērus ar konsekventu garumu

Dažpiemēru piemēri, kas atbilst vēlamajam garumam, palīdz modelim turpināt paraugu.

Apturēšanas sekvenču stratēģiska izmantošana

Izmantojiet stop, lai apturētu ģenerēšanu, kad modelis sasniedz atdalītāju vai numurēta saraksta robežu.

{ "stop": ["
###", "6."] }

Vairāki varianti

  • Tērzēšanas pabeigšana: n vienā izsaukumā atgriež vairākus pabeigšanas rezultātus.

  • Atbilžu API: n netiek atbalstīts; ja vajadzīgs vairāk nekā viens rezultāts, veiciet vairākus izsaukumus.

Vai šis raksts bija noderīgs?