Επισκόπηση
Ο έλεγχος του μήκους της απόκρισης ενός μοντέλου είναι χρήσιμος για διάφορους λόγους: βοηθά στη διαχείριση του κόστους (αφού πληρώνετε ανά token), βελτιώνει την καθυστέρηση/απόδοση (οι συντομότερες αποκρίσεις επιστρέφονται πιο γρήγορα) και διασφαλίζει τη συνάφεια αποφεύγοντας υπερβολικά μεγάλες ή φλύαρες εξόδους.
Μπορείτε να το πετύχετε αυτό χρησιμοποιώντας ανώτατα όρια token, ρυθμίσεις συλλογιστικής και επιπέδου λεπτομέρειας, σαφείς οδηγίες, παραδείγματα και ακολουθίες διακοπής. Για τις πιο πρόσφατες και πλήρεις λεπτομέρειες, να ανατρέχετε πάντα στην επίσημη αναφορά API στο platform.openai.com.
Ορίστε μέγιστο μήκος εξόδου
Responses API
Χρησιμοποιείται για τα μοντέλα GPT-5 και τα περισσότερα μοντέλα της σειράς o: χρησιμοποιήστε την παράμετρο max_output_tokens για να περιορίσετε τον αριθμό των token που θα παράγει το μοντέλο. Για αιτήματα compaction_trigger, είτε παραλείψτε την παράμετρο max_output_tokens είτε ορίστε την σε τουλάχιστον 20000· οι μικρότερες τιμές απορρίπτονται. Το Responses API δεν υποστηρίζει πολλαπλές ολοκληρώσεις (n).
Chat Completions API
Χρησιμοποιείται για τα παλαιότερα GPT-3.5 και GPT-4o, καθώς και ορισμένες φορές για τη σειρά o.
Για μοντέλα συλλογιστικής όπως τα o3 και o4-mini, χρησιμοποιήστε την παράμετρο max_completion_tokens (ψευδώνυμο της max_tokens)
Για παλαιότερα μοντέλα ή μοντέλα χωρίς συλλογιστική, η παράμετρος max_tokens εξακολουθεί να λειτουργεί
Υποστηρίζει τις παραμέτρους stop και n (πολλαπλές ολοκληρώσεις).
Σημείωση: Δεν υπάρχει ρύθμιση «ελάχιστων tokens». Αν χρειάζεστε ελάχιστο μήκος, καθορίστε το στην προτροπή σας.
Όρια token ανά ομάδα μοντέλων
Για τα πιο πρόσφατα όρια token, μεγέθη περιβάλλοντος και ανώτατα όρια εξόδου, ανατρέξτε στην τεκμηρίωση του συγκεκριμένου μοντέλου.
Γρήγορα παραδείγματα
Responses API
{ "model": "gpt-5", "input": "Σύνοψε τα ευρήματα σε ~80 λέξεις.", "max_output_tokens": 120 }Chat Completions (μοντέλο συλλογιστικής)
{ "model": "o3-mini", "messages": [{"role": "user", "content": "Write five one-line options."}], "max_completion_tokens": 100 }Ειδικές ρυθμίσεις για τα μοντέλα GPT-5: verbosity και reasoning.effort
Αυτές οι ρυθμίσεις είναι διαθέσιμες μόνο στα μοντέλα GPT-5 (gpt-5.2, gpt-5.2-chat-latest, gpt-5.2 pro κ.λπ.). Τα μοντέλα της σειράς o και τα παλαιότερα μοντέλα δεν τις υποστηρίζουν.
Η παράμετρος verbosity δέχεται τις τιμές "low", "medium" (προεπιλογή) ή "high". Επηρεάζει το επίπεδο λεπτομέρειας, αλλά όχι τα αυστηρά όρια.
{ "model": "gpt-5", "input": "Εξήγησε το PageRank σε υψηλό επίπεδο.", "text": { "verbosity": "low" }, "max_output_tokens": 200 }Η παράμετρος reasoning.effort ελέγχει πόσα token συλλογιστικής παράγονται πριν δοθεί μια απάντηση. Το GPT-5.2 υποστηρίζει τις τιμές none, low, medium, high και xhigh. Το gpt-5.2-pro υποστηρίζει μόνο τις τιμές medium, high και xhigh. Τα παλαιότερα μοντέλα συλλογιστικής υποστηρίζουν μόνο τις τιμές low, medium και high.
{ "model": "gpt-5", "input": "Πόσο χρυσό θα χρειαζόταν για να καλυφθεί το Άγαλμα της Ελευθερίας με στρώμα 1 mm;", "reasoning": { "effort": "minimal" } }Μπορείτε να ορίσετε την παράμετρο reasoning.effort σε none, ώστε το μοντέλο να συμπεριφέρεται ως μοντέλο χωρίς συλλογιστική για περιπτώσεις χρήσης που απαιτούν χαμηλό χρόνο απόκρισης.
Δώστε συγκεκριμένες οδηγίες
Ζητήστε το ακριβές μήκος ή τη μορφή που θέλετε. Παραδείγματα:
«Καταγράψτε ακριβώς πέντε επιλογές.»
«Γράψτε μια σύνοψη 50 λέξεων.»
«Όχι περισσότερα από 100 token. Αν χρειάζεστε περισσότερο χώρο, πείτε “Χρειάζομαι περισσότερο χώρο”.»
Χρησιμοποιήστε παραδείγματα με συνεπές μήκος
Τα παραδείγματα με λίγα παραδείγματα (few-shot) που ταιριάζουν με το επιθυμητό μήκος βοηθούν το μοντέλο να συνεχίσει το μοτίβο.
Χρησιμοποιήστε στρατηγικά ακολουθίες διακοπής
Χρησιμοποιήστε την παράμετρο stop για να διακόψετε την παραγωγή όταν το μοντέλο φτάσει σε έναν οριοθέτη ή στο όριο μιας αριθμημένης λίστας.
{ "stop": ["
###", "6."] }Πολλαπλές υποψήφιες απαντήσεις
Chat Completions: Η παράμετρος n επιστρέφει πολλαπλές ολοκληρώσεις με μία κλήση.
Responses API: Η παράμετρος n δεν υποστηρίζεται· πραγματοποιήστε πολλαπλές κλήσεις αν χρειάζεστε περισσότερες από μία εξόδους.
