Yfirlit
Að stýra lengd svars líkans er gagnlegt af ýmsum ástæðum: það hjálpar til við að stjórna kostnaði (þar sem greitt er fyrir hvern tóka), bætir biðtíma/afköst (styttri svör skila sér hraðar) og tryggir viðeigandi svör með því að forðast of löng eða orðmörg úttök.
Þessu má ná með tókaþökum, stillingum fyrir rök og orðagnótt, skýrum leiðbeiningum, dæmum og stöðvunarröðum. Fyrir nýjustu og ítarlegustu upplýsingarnar skaltu alltaf skoða opinberu API-tilvísunina á platform.openai.com.
Stilltu hámarkslengd úttaks
Responses API
Fyrir GPT-5-líkön og flest líkön í o-línunni: notaðu max_output_tokens til að takmarka fjölda tóka sem líkanið myndar. Fyrir compaction_trigger-beiðnir skaltu annaðhvort sleppa max_output_tokens eða stilla það á að minnsta kosti 20000; lægri gildum er hafnað. Responses API styður ekki mörg svör (n).
API fyrir spjalllok
Notað fyrir eldri GPT-3.5- og GPT-4o-líkön og stundum líkön í o-línunni.
Fyrir rakalíkön á borð við o3 og o4-mini skaltu nota max_completion_tokens (samheiti max_tokens)
Fyrir eldri líkön og líkön sem eru ekki rakalíkön virkar max_tokens enn
Styður stop og n (mörg svör).
Athugið: Það er engin „lágmarks tókar“ stilling. Ef þú þarft lágmarkslengd skaltu tilgreina hana í kvaðningunni þinni.
Tókamörk eftir líkanahópi
Fyrir nýjustu tókamörk, samhengisstærðir og úttaksþök skaltu skoða skjölun fyrir tiltekið líkan.
Fljótleg dæmi
Responses API
{ "model": "gpt-5", "input": "Taktu saman helstu niðurstöður í ~80 orðum.", "max_output_tokens": 120 }Spjalllok (rakalíkan)
{ "model": "o3-mini", "messages": [{"role": "user", "content": "Write five one-line options."}], "max_completion_tokens": 100 }Sérstakar stýringar GPT-5-líkana: verbosity og reasoning.effort
Þessar stýringar eru aðeins í boði fyrir GPT-5-líkön (gpt-5.2, gpt-5.2-chat-latest, gpt-5.2 pro o.s.frv.). Líkön í o-línunni og eldri líkön styðja þær ekki.
verbosity tekur við "low", "medium" (sjálfgefið) eða "high". Það hefur áhrif á ítarleika en ekki föst mörk.
{ "model": "gpt-5", "input": "Útskýrðu PageRank á háu stigi.", "text": { "verbosity": "low" }, "max_output_tokens": 200 }reasoning.effort stýrir því hversu margir röktókar eru myndaðir áður en svar er útbúið. GPT-5.2 styður none, low, medium, high og xhigh. gpt-5.2-pro styður aðeins medium, high og xhigh. Eldri rakalíkön styðja aðeins low, medium og high.
{ "model": "gpt-5", "input": "Hversu mikið gull þyrfti til að húða Frelsisstyttuna með 1 mm lagi?", "reasoning": { "effort": "minimal" } }Þú getur stillt reasoning.effort á none svo líkanið hegði sér eins og líkan sem er ekki rakalíkan þegar lítil biðtími skiptir máli.
Gefðu nákvæmar leiðbeiningar
Biddu um nákvæma lengd eða form sem þú vilt. Dæmi:
„Teldu upp nákvæmlega fimm valkosti.“
„Skrifaðu 50 orða samantekt.“
„Ekki fleiri en 100 tókar. Ef þú þarft meira, segðu ‚Þarf meira pláss.‘“
Notaðu dæmi með samræmdri lengd
Fá-skot dæmi sem passa við æskilega lengd hjálpa líkaninu að halda mynstrinu áfram.
Beittu stöðvunarrunum með markvissum hætti
Notaðu stop til að stöðva myndun þegar líkanið kemur að afmarkara eða mörkum tölusetts lista.
{ "stop": ["
###", "6."] }Mörg möguleg svör
Spjalllok: n skilar mörgum svörum í einu kalli.
Responses API: n er ekki stutt; sendu fleiri köll ef þú þarft fleiri en eitt úttak.
