Шолу
Модель жауабының ұзындығын басқару бірнеше себеппен пайдалы: шығынды бақылауға көмектеседі (өйткені төлем әр токен үшін алынады), кідіріс пен өнімділікті жақсартады (қысқа жауаптар жылдамырақ қайтарылады) және тым ұзақ не тым көпсөзді шығыстарды болдырмай, өзектілікті сақтайды.
Бұған токен лимиттері, ой қорыту мен егжей-тегжейлілік параметрлері, анық нұсқаулар, мысалдар және тоқтату тізбектері арқылы қол жеткізе аласыз. Ең жаңа әрі толық мәлімет үшін әрқашан platform.openai.com сайтындағы ресми API анықтамалығын қараңыз.
Ең көп шығыс ұзындығын орнатыңыз
Responses API
GPT-5 модельдері және o-series модельдерінің көбі үшін қолданылады: модель жасайтын токен санын шектеу үшін max_output_tokens пайдаланыңыз. compaction_trigger сұрауларында max_output_tokens параметрін көрсетпеңіз немесе оны кемінде 20000 етіп орнатыңыз; бұдан кіші мәндер қабылданбайды. Responses API бірнеше толықтыруды (n) қолдамайды.
Чат жауаптарын құратын API
Бұрынғы GPT-3.5, GPT-4o және кейде o-series үшін қолданылады.
o3 және o4-mini сияқты ойлайтын модельдер үшін
max_completion_tokensпайдаланыңыз (max_tokensбаламасы).Бұрынғы/ойлайтын емес модельдер үшін
max_tokensәлі де жұмыс істейді.stopжәнеn(бірнеше толықтыру) параметрлерін қолдайды.
Ескерту: “Ең аз токен” деген баптау жоқ. Ең аз ұзындық керек болса, оны көмексөзіңізде нақты көрсетіңіз.
Модель тобы бойынша токен шектеулері
Токен шектеулері, контекст өлшемдері және шығыс лимиттері туралы ең жаңа ақпарат үшін нақты модель құжаттамасын қараңыз.
Жылдам мысалдар
Responses API
{ "model": "gpt-5", "input": "Нәтижелерді шамамен 80 сөзбен қорытындыла.", "max_output_tokens": 120 }Chat Completions (ойлайтын модель)
{ "model": "o3-mini", "messages": [{"role": "user", "content": "Write five one-line options."}], "max_completion_tokens": 100 }GPT-5 модельдеріне арналған арнайы басқару параметрлері: verbosity және reasoning.effort
Бұл басқару параметрлері тек GPT-5 модельдерінде қолжетімді (gpt-5.2, gpt-5.2-chat-latest, gpt-5.2 pro және т.б.). O-series және бұрынғы модельдер оларды қолдамайды.
`verbosity` мәні ретінде "low", "medium" (әдепкі) немесе "high" қабылдайды. Ол егжей-тегжей деңгейіне әсер етеді, бірақ қатаң шектеулерді өзгертпейді.
{ "model": "gpt-5", "input": "PageRank-ті жалпы деңгейде түсіндір.", "text": { "verbosity": "low" }, "max_output_tokens": 200 }`reasoning.effort` жауап шығарылғанға дейін қанша ой қорыту токені жасалатынын басқарады. GPT-5.2 none,low, medium, high,and xhigh мәндерін қолдайды. gpt-5.2-pro тек medium, high,and xhigh мәндерін қолдайды. Бұрынғы ойлайтын модельдер тек low, medium және high мәндерін қолдайды.
{ "model": "gpt-5", "input": "Азаттық мүсінін 1 мм қабатпен қаптау үшін қанша алтын керек болар еді?", "reasoning": { "effort": "minimal" } }Кідіріс маңызды қолдану жағдайларында модель ойлайтын емес модель сияқты әрекет етуі үшін `reasoning.effort` параметрін none мәніне орната аласыз.
Нақты нұсқаулар беріңіз
Қажет нақты ұзындықты немесе пішімді сұраңыз. Мысалдар:
«Дәл бес нұсқаны тізіңіз».
«50 сөзден тұратын түйіндеме жазыңыз».
«100 токеннен артық емес. Көбірек орын керек болса, “Көбірек орын керек” деп айтыңыз».
Ұзындығы біркелкі мысалдарды пайдаланыңыз
Қалаған ұзындыққа сай аз мысалмен үйрету мысалдары модельге үлгіні жалғастыруға көмектеседі.
Стратегиялық тоқтату тізбектерін қолданыңыз
Модель бөлгішке немесе нөмірленген тізім шегіне жеткенде генерацияны тоқтату үшін stop пайдаланыңыз.
{ "stop": ["
###", "6."] }Бірнеше үміткер
Chat Completions:
nбір шақыруда бірнеше толықтыруды қайтарады.Responses API:
nқолдамайды; бірден көп шығыс қажет болса, бірнеше шақыру жасаңыз.
