OpenAI
Þessi síða var vélþýdd. Skoða upprunalegu ensku greinina.

Stýring á lengd svara frá OpenAI-líkönum

Lærðu að setja úttaksmörk fyrir OpenAI-líkön með tókastillingum, skýrum kvaðningum, dæmum og stöðvunarrunum.

Uppfært: 5 days ago

Yfirlit

Að stýra lengd svars líkans er gagnlegt af ýmsum ástæðum: það hjálpar til við að stjórna kostnaði (þar sem greitt er fyrir hvern tóka), bætir biðtíma/afköst (styttri svör skila sér hraðar) og tryggir viðeigandi svör með því að forðast of löng eða orðmörg úttök.

Þessu má ná með tókaþökum, stillingum fyrir rök og orðagnótt, skýrum leiðbeiningum, dæmum og stöðvunarröðum. Fyrir nýjustu og ítarlegustu upplýsingarnar skaltu alltaf skoða opinberu API-tilvísunina á platform.openai.com.

Stilltu hámarkslengd úttaks

Responses API

Fyrir GPT-5-líkön og flest líkön í o-línunni: notaðu max_output_tokens til að takmarka fjölda tóka sem líkanið myndar. Fyrir compaction_trigger-beiðnir skaltu annaðhvort sleppa max_output_tokens eða stilla það á að minnsta kosti 20000; lægri gildum er hafnað. Responses API styður ekki mörg svör (n).

API fyrir spjalllok

Notað fyrir eldri GPT-3.5- og GPT-4o-líkön og stundum líkön í o-línunni.

  • Fyrir rakalíkön á borð við o3 og o4-mini skaltu nota max_completion_tokens (samheiti max_tokens)

  • Fyrir eldri líkön og líkön sem eru ekki rakalíkön virkar max_tokens enn

  • Styður stop og n (mörg svör).

Athugið: Það er engin „lágmarks tókar“ stilling. Ef þú þarft lágmarkslengd skaltu tilgreina hana í kvaðningunni þinni.

Tókamörk eftir líkanahópi

Fyrir nýjustu tókamörk, samhengisstærðir og úttaksþök skaltu skoða skjölun fyrir tiltekið líkan.

Fljótleg dæmi

Responses API

{ "model": "gpt-5", "input": "Taktu saman helstu niðurstöður í ~80 orðum.", "max_output_tokens": 120 }

Spjalllok (rakalíkan)

{ "model": "o3-mini", "messages": [{"role": "user", "content": "Write five one-line options."}], "max_completion_tokens": 100 }

Sérstakar stýringar GPT-5-líkana: verbosity og reasoning.effort

Þessar stýringar eru aðeins í boði fyrir GPT-5-líkön (gpt-5.2, gpt-5.2-chat-latest, gpt-5.2 pro o.s.frv.). Líkön í o-línunni og eldri líkön styðja þær ekki.


verbosity tekur við "low", "medium" (sjálfgefið) eða "high". Það hefur áhrif á ítarleika en ekki föst mörk.

{ "model": "gpt-5", "input": "Útskýrðu PageRank á háu stigi.", "text": { "verbosity": "low" }, "max_output_tokens": 200 }

reasoning.effort stýrir því hversu margir röktókar eru myndaðir áður en svar er útbúið. GPT-5.2 styður none, low, medium, high og xhigh. gpt-5.2-pro styður aðeins medium, high og xhigh. Eldri rakalíkön styðja aðeins low, medium og high.

{ "model": "gpt-5", "input": "Hversu mikið gull þyrfti til að húða Frelsisstyttuna með 1 mm lagi?", "reasoning": { "effort": "minimal" } }

Þú getur stillt reasoning.effort á none svo líkanið hegði sér eins og líkan sem er ekki rakalíkan þegar lítil biðtími skiptir máli.

Gefðu nákvæmar leiðbeiningar

Biddu um nákvæma lengd eða form sem þú vilt. Dæmi:

  • „Teldu upp nákvæmlega fimm valkosti.“

  • „Skrifaðu 50 orða samantekt.“

  • „Ekki fleiri en 100 tókar. Ef þú þarft meira, segðu ‚Þarf meira pláss.‘“

Notaðu dæmi með samræmdri lengd

Fá-skot dæmi sem passa við æskilega lengd hjálpa líkaninu að halda mynstrinu áfram.

Beittu stöðvunarrunum með markvissum hætti

Notaðu stop til að stöðva myndun þegar líkanið kemur að afmarkara eða mörkum tölusetts lista.

{ "stop": ["
###", "6."] }

Mörg möguleg svör

  • Spjalllok: n skilar mörgum svörum í einu kalli.

  • Responses API: n er ekki stutt; sendu fleiri köll ef þú þarft fleiri en eitt úttak.

Var þessi grein gagnleg?