Шолу
Модель жауабының ұзындығын басқару бірнеше себеппен пайдалы: шығынды бақылауға көмектеседі (өйткені төлем әр токен үшін алынады), кідіріс пен өнімділікті жақсартады (қысқа жауаптар жылдамырақ қайтарылады) және тым ұзақ не тым көпсөзді шығыстарды болдырмай, өзектілікті сақтайды.
Бұған токен лимиттері, ой қорыту мен егжей-тегжейлілік параметрлері, анық нұсқаулар, мысалдар және тоқтату тізбектері арқылы қол жеткізе аласыз. Ең жаңа әрі толық мәлімет үшін әрқашан platform.openai.com сайтындағы ресми API анықтамалығын қараңыз.
Ең көп шығыс ұзындығын орнатыңыз
Responses API
GPT-5 модельдері мен o-сериялы модельдердің көбінде қолданылады: модель жасайтын токендер санын шектеу үшін max_output_tokens параметрін пайдаланыңыз. compaction_trigger сұрауларында max_output_tokens параметрін көрсетпеңіз немесе оның мәнін кемінде 20000 етіп орнатыңыз; бұдан кіші мәндер қабылданбайды. Responses API бірнеше жауапты (n) қолдамайды.
Чат жауаптарын құратын API
Бұрынғы GPT-3.5, GPT-4o модельдерінде және кейде o-сериясында қолданылады.
o3 және o4-mini сияқты ойлайтын модельдер үшін max_completion_tokens параметрін (max_tokens параметрінің балама атауы) пайдаланыңыз
Бұрынғы немесе ой қорытуға арналмаған модельдерде max_tokens параметрі әлі де жұмыс істейді
stop және n параметрлерін (бірнеше жауап) қолдайды.
Ескерту: “Ең аз токен” деген баптау жоқ. Ең аз ұзындық керек болса, оны көмексөзіңізде нақты көрсетіңіз.
Модель тобы бойынша токен шектеулері
Токен шектеулері, контекст өлшемдері және шығыс лимиттері туралы ең жаңа ақпарат үшін нақты модель құжаттамасын қараңыз.
Жылдам мысалдар
Responses API
{ "model": "gpt-5", "input": "Нәтижелерді шамамен 80 сөзбен қорытындыла.", "max_output_tokens": 120 }Chat Completions (ойлайтын модель)
{ "model": "o3-mini", "messages": [{"role": "user", "content": "Write five one-line options."}], "max_completion_tokens": 100 }GPT-5 модельдеріне тән басқару параметрлері: verbosity және reasoning.effort
Бұл басқару параметрлері тек GPT-5 модельдерінде қолжетімді (gpt-5.2, gpt-5.2-chat-latest, gpt-5.2 pro және т.б.). O-сериялы және бұрынғы модельдер оларды қолдамайды.
verbosity параметрі "low", "medium" (әдепкі мән) немесе "high" мәндерін қабылдайды. Ол егжей-тегжейлілік деңгейіне әсер етеді, бірақ қатаң шектеулерді өзгертпейді.
{ "model": "gpt-5", "input": "PageRank-ті жалпы деңгейде түсіндір.", "text": { "verbosity": "low" }, "max_output_tokens": 200 }reasoning.effort параметрі жауап шығарылғанға дейін қанша ой қорыту токені жасалатынын басқарады. GPT-5.2 моделі none, low, medium, high және xhigh мәндерін қолдайды. gpt-5.2-pro тек medium, high және xhigh мәндерін қолдайды. Бұрынғы ойлайтын модельдер тек low, medium және high мәндерін қолдайды.
{ "model": "gpt-5", "input": "Азаттық мүсінін 1 мм қабатпен қаптау үшін қанша алтын керек болар еді?", "reasoning": { "effort": "minimal" } }Кідіріс аса маңызды жағдайларда модельді ой қорытуға арналмаған модель сияқты жұмыс істету үшін reasoning.effort параметрін none мәніне орнатуға болады.
Нақты нұсқаулар беріңіз
Қажет нақты ұзындықты немесе пішімді сұраңыз. Мысалдар:
«Дәл бес нұсқаны тізіңіз».
«50 сөзден тұратын түйіндеме жазыңыз».
«100 токеннен артық емес. Көбірек орын керек болса, “Көбірек орын керек” деп айтыңыз».
Ұзындығы біркелкі мысалдарды пайдаланыңыз
Қалаған ұзындыққа сай аз мысалмен үйрету мысалдары модельге үлгіні жалғастыруға көмектеседі.
Тоқтату тізбектерін орнымен қолданыңыз
Модель бөлгішке немесе нөмірленген тізімнің шегіне жеткенде генерацияны тоқтату үшін stop параметрін пайдаланыңыз.
{ "stop": ["
###", "6."] }Бірнеше балама
Чат жауаптарын құратын API: n бір шақыруда бірнеше жауап қайтарады.
Responses API: n параметрі қолдау таппайды; бірнеше нәтиже қажет болса, бірнеше шақыру жасаңыз.
