Áttekintés
Egy modell válaszhosszának szabályozása több okból is hasznos: segít kezelni a költségeket (mivel tokenenként fizet), javítja a késleltetést/teljesítményt (a rövidebb válaszok gyorsabban érkeznek meg), és biztosítja a relevanciát azáltal, hogy elkerüli a túl hosszú vagy bőbeszédű kimeneteket.
Ezt tokenkorlátokkal, érvelési és részletességi beállításokkal, egyértelmű utasításokkal, példákkal és leállítási szekvenciákkal érheti el. A legfrissebb és legteljesebb részletekért mindig tekintse meg a hivatalos API-referenciát a platform.openai.com webhelyen.
Állítson be maximális kimeneti hosszt
Responses API
A GPT-5 modelleknél és az o-sorozat legtöbb modelljénél használatos: a max_output_tokens paraméterrel korlátozhatja a modell által generált tokenek számát. A compaction_trigger kéréseknél hagyja el a max_output_tokens paramétert, vagy állítsa legalább 20000 értékre; a kisebb értékeket a rendszer elutasítja. A Responses API nem támogat több befejezést (n).
Csevegés-befejezési API
A régebbi GPT-3.5 és GPT-4o modelleknél, valamint esetenként az o-sorozatnál használatos.
Az olyan érvelési modelleknél, mint az o3 és az o4-mini, használja a max_completion_tokens paramétert (a max_tokens aliasát)
A korábbi, illetve nem érvelési modelleknél továbbra is működik a max_tokens
Támogatja a stop és az n paramétert (több befejezés).
Megjegyzés: Nincs „minimális tokenszám” beállítás. Ha minimális hosszra van szüksége, adja meg az utasításban.
Tokenkorlátok modellcsoport szerint
A naprakész tokenkorlátokért, kontextusméretekért és kimeneti korlátokért tekintse meg az adott modell dokumentációját.
Gyors példák
Responses API
{ "model": "gpt-5", "input": "Foglald össze a megállapításokat kb. 80 szóban.", "max_output_tokens": 120 }Csevegés-befejezések (érvelési modell)
{ "model": "o3-mini", "messages": [{"role": "user", "content": "Write five one-line options."}], "max_completion_tokens": 100 }A GPT-5 modellek speciális vezérlői: verbosity és reasoning.effort
Ezek a vezérlők csak a GPT-5 modelleken érhetők el (gpt-5.2, gpt-5.2-chat-latest, gpt-5.2 pro stb.). Az o-sorozat és a régebbi modellek nem támogatják őket.
A verbosity értéke "low", "medium" (alapértelmezett) vagy "high" lehet. Befolyásolja a részletesség szintjét, de a rögzített korlátokat nem.
{ "model": "gpt-5", "input": "Magyarázd el magas szinten a PageRanket.", "text": { "verbosity": "low" }, "max_output_tokens": 200 }A reasoning.effort szabályozza, hogy hány érvelési token generálódjon a válasz elkészítése előtt. A GPT-5.2 a none, low, medium, high és xhigh értékeket támogatja. A gpt-5.2-pro csak a medium, high és xhigh értékeket támogatja. A korábbi érvelési modellek csak a low, medium és high értékeket támogatják.
{ "model": "gpt-5", "input": "Mennyi arany kellene a Szabadság-szobor 1 mm-es bevonásához?", "reasoning": { "effort": "minimal" } }A késleltetésre érzékeny felhasználási esetekben a reasoning.effort értékét none-ra állítva a modell nem érvelési modellként viselkedik.
Adjon meg konkrét utasításokat
Kérje a kívánt pontos hosszt vagy formát. Példák:
„Soroljon fel pontosan öt lehetőséget.”
„Írjon 50 szavas összefoglalót.”
„Legfeljebb 100 token. Ha többre van szüksége, írja: „Több hely kell.””
Használjon egységes hosszúságú példákat
A kívánt hosszúsághoz illeszkedő kevés lövéses példák segítenek a modellnek folytatni a mintát.
Használjon stratégiai leállítási szekvenciákat
A stop használatával leállíthatja a generálást, amikor a modell elér egy határolójelet vagy egy számozott lista határát.
{ "stop": ["
###", "6."] }Több válaszlehetőség
Csevegés-befejezések: az n egyetlen hívással több befejezést ad vissza.
Responses API: az n nem támogatott; ha egynél több kimenetre van szüksége, indítson több hívást.
