OpenAI
Ez az oldal gépi fordítással készült. Tekintsd meg az eredeti angol nyelvű cikket.

Az OpenAI modellválaszok hosszának szabályozása

Ismerje meg, hogyan állíthat be kimeneti korlátokat az OpenAI modellekhez tokenbeállításokkal, egyértelmű utasításokkal, példákkal és leállítási szekvenciákkal.

Frissítve: 12 days ago

Áttekintés

Egy modell válaszhosszának szabályozása több okból is hasznos: segít kezelni a költségeket (mivel tokenenként fizet), javítja a késleltetést/teljesítményt (a rövidebb válaszok gyorsabban érkeznek meg), és biztosítja a relevanciát azáltal, hogy elkerüli a túl hosszú vagy bőbeszédű kimeneteket.

Ezt tokenkorlátokkal, érvelési és részletességi beállításokkal, egyértelmű utasításokkal, példákkal és leállítási szekvenciákkal érheti el. A legfrissebb és legteljesebb részletekért mindig tekintse meg a hivatalos API-referenciát a platform.openai.com webhelyen.

Állítson be maximális kimeneti hosszt

Responses API

A GPT-5 modelleknél és az o-sorozat legtöbb modelljénél használatos: a max_output_tokens paraméterrel korlátozhatja a modell által generált tokenek számát. A compaction_trigger kéréseknél hagyja el a max_output_tokens paramétert, vagy állítsa legalább 20000 értékre; a kisebb értékeket a rendszer elutasítja. A Responses API nem támogat több befejezést (n).

Csevegés-befejezési API

A régebbi GPT-3.5 és GPT-4o modelleknél, valamint esetenként az o-sorozatnál használatos.

  • Az olyan érvelési modelleknél, mint az o3 és az o4-mini, használja a max_completion_tokens paramétert (a max_tokens aliasát)

  • A korábbi, illetve nem érvelési modelleknél továbbra is működik a max_tokens

  • Támogatja a stop és az n paramétert (több befejezés).

Megjegyzés: Nincs „minimális tokenszám” beállítás. Ha minimális hosszra van szüksége, adja meg az utasításban.

Tokenkorlátok modellcsoport szerint

A naprakész tokenkorlátokért, kontextusméretekért és kimeneti korlátokért tekintse meg az adott modell dokumentációját.

Gyors példák

Responses API

{ "model": "gpt-5", "input": "Foglald össze a megállapításokat kb. 80 szóban.", "max_output_tokens": 120 }

Csevegés-befejezések (érvelési modell)

{ "model": "o3-mini", "messages": [{"role": "user", "content": "Write five one-line options."}], "max_completion_tokens": 100 }

A GPT-5 modellek speciális vezérlői: verbosity és reasoning.effort

Ezek a vezérlők csak a GPT-5 modelleken érhetők el (gpt-5.2, gpt-5.2-chat-latest, gpt-5.2 pro stb.). Az o-sorozat és a régebbi modellek nem támogatják őket.

A verbosity értéke "low", "medium" (alapértelmezett) vagy "high" lehet. Befolyásolja a részletesség szintjét, de a rögzített korlátokat nem.

{ "model": "gpt-5", "input": "Magyarázd el magas szinten a PageRanket.", "text": { "verbosity": "low" }, "max_output_tokens": 200 }

A reasoning.effort szabályozza, hogy hány érvelési token generálódjon a válasz elkészítése előtt. A GPT-5.2 a none, low, medium, high és xhigh értékeket támogatja. A gpt-5.2-pro csak a medium, high és xhigh értékeket támogatja. A korábbi érvelési modellek csak a low, medium és high értékeket támogatják.

{ "model": "gpt-5", "input": "Mennyi arany kellene a Szabadság-szobor 1 mm-es bevonásához?", "reasoning": { "effort": "minimal" } }

A késleltetésre érzékeny felhasználási esetekben a reasoning.effort értékét none-ra állítva a modell nem érvelési modellként viselkedik.

Adjon meg konkrét utasításokat

Kérje a kívánt pontos hosszt vagy formát. Példák:

  • „Soroljon fel pontosan öt lehetőséget.”

  • „Írjon 50 szavas összefoglalót.”

  • „Legfeljebb 100 token. Ha többre van szüksége, írja: „Több hely kell.””

Használjon egységes hosszúságú példákat

A kívánt hosszúsághoz illeszkedő kevés lövéses példák segítenek a modellnek folytatni a mintát.

Használjon stratégiai leállítási szekvenciákat

A stop használatával leállíthatja a generálást, amikor a modell elér egy határolójelet vagy egy számozott lista határát.

{ "stop": ["
###", "6."] }

Több válaszlehetőség

  • Csevegés-befejezések: az n egyetlen hívással több befejezést ad vissza.

  • Responses API: az n nem támogatott; ha egynél több kimenetre van szüksége, indítson több hívást.

Hasznos volt ez a cikk?