OpenAI
See leht on masintõlgitud. Vaadake algset ingliskeelset artiklit.

OpenAI mudelivastuste pikkuse juhtimine

Vaata, kuidas määrata OpenAI mudelite väljundipiire tokeni sätete, selgete viipade, näidete ja stopp-jadade abil.

Värskendatud: 18 days ago

Ülevaade

Mudeli vastuse pikkuse juhtimine on kasulik mitmel põhjusel: see aitab hallata kulu (sest maksad tokeni kohta), parandab latentsust/jõudlust (lühemad vastused tagastatakse kiiremini) ja tagab asjakohasuse, vältides liiga pikki või paljusõnalisi väljundeid.

Saad seda teha tokenipiirangute, arutluse ja paljusõnalisuse sätete, selgete juhiste, näidete ja peatamisjärjendite abil. Kõige ajakohasemate ja täielikumate üksikasjade jaoks vaata alati ametlikku API viidet saidil platform.openai.com.

Määra maksimaalne väljundi pikkus

Vastuste API

Kasutatakse GPT-5 mudelite ja enamiku o-seeria mudelitega: mudeli genereeritavate tokenite arvu piiramiseks kasutage parameetrit max_output_tokens. Parameetriga compaction_trigger päringutes jätke max_output_tokens välja või määrake selle väärtuseks vähemalt 20000; väiksemad väärtused lükatakse tagasi. Vastuste API ei toeta mitut lõpetamist (n).

Vestluse lõpetamise API

Kasutatakse pärandmudelite GPT-3.5 ja GPT-4o ning mõnikord o-seeria mudelitega.

  • Selliste arutlusmudelite nagu o3 ja o4-mini puhul kasutage parameetrit max_completion_tokens (parameetri max_tokens alias)

  • Varasemate ja mitte-arutlusmudelite puhul töötab endiselt max_tokens

  • Toetab parameetreid stop ja n (mitu lõpetamist).

Märkus: Sätet „miinimumtokenid” ei ole. Kui vajad minimaalset pikkust, täpsusta see oma viibas.

Tokenipiirangud mudelirühma järgi

Ajakohaste tokenipiirangute, konteksti suuruste ja väljundipiirangute kohta vaata konkreetse mudeli dokumentatsiooni.

Kiirnäited

Responses API

{ "model": "gpt-5", "input": "Võta leiud kokku ~80 sõnaga.", "max_output_tokens": 120 }

Vestluse lõpetamised (arutlusmudel)

{ "model": "o3-mini", "messages": [{"role": "user", "content": "Write five one-line options."}], "max_completion_tokens": 100 }

GPT-5 mudelite erijuhtelemendid: verbosity ja reasoning.effort

Need juhtelemendid on saadaval ainult GPT-5 mudelites (gpt-5.2, gpt-5.2-chat-latest, gpt-5.2 pro jne). O-seeria ja pärandmudelid neid ei toeta.


verbosity väärtuseks sobib "low", "medium" (vaikimisi) või "high". See mõjutab üksikasjalikkust, kuid mitte jäiku piiranguid.

{ "model": "gpt-5", "input": "Selgita PageRanki üldtasemel.", "text": { "verbosity": "low" }, "max_output_tokens": 200 }

reasoning.effort määrab, mitu arutlustokenit genereeritakse enne vastuse koostamist. GPT-5.2 toetab väärtusi none, low, medium, high ja xhigh. gpt-5.2-pro toetab ainult väärtusi medium, high ja xhigh. Varasemad arutlusmudelid toetavad ainult väärtusi low, medium ja high.

{ "model": "gpt-5", "input": "Kui palju kulda kuluks Vabadussamba katmiseks 1 mm kihiga?", "reasoning": { "effort": "minimal" } }

Latentsustundlike kasutusjuhtude korral võite määrata parameetri reasoning.effort väärtuseks none, et mudel käituks nagu mitte-arutlusmudel.

Anna konkreetsed juhised

Küsi täpselt soovitud pikkust või vormi. Näited:

  • „Loetle täpselt viis võimalust.“

  • „Kirjuta 50-sõnaline kokkuvõte.“

  • „Mitte rohkem kui 100 tokenit. Kui vajad rohkem, ütle: „Vajan rohkem ruumi.““

Kasuta ühtlase pikkusega näiteid

Sinu soovitud pikkusele vastavad väheste näidetega näited aitavad mudelil mustrit jätkata.

Rakendage strateegilisi peatamisjadasid

Kasutage parameetrit stop, et peatada genereerimine, kui mudel jõuab eraldaja või nummerdatud loendi piirini.

{ "stop": ["
###", "6."] }

Mitu kandidaati

  • Vestluse lõpetamised: n tagastab ühe kutsega mitu lõpetamist.

  • Vastuste API: parameetrit n ei toetata; kui vajate mitut väljundit, tehke mitu kutset.

Kas sellest artiklist oli abi?