OpenAI
Αυτή η σελίδα μεταφράστηκε αυτόματα. Δείτε το πρωτότυπο άρθρο στα αγγλικά.

Ανοικτά μοντέλα βαρών της OpenAI (gpt-oss)

Μάθετε για τα ανοικτά μοντέλα βαρών της OpenAI (gpt-oss) και πού θα βρείτε υποστήριξη

Τελευταία ενημέρωση: 10 days ago

Σημείωση: Αυτό το άρθρο παρέχει μια επισκόπηση υψηλού επιπέδου. Πληροφορίες για την τεχνική ρύθμιση μπορείτε να βρείτε στον ιστότοπο gpt-oss, στο GitHub, στο Hugging Face και στα OpenAI Cookbooks.

Επισκόπηση

Παρουσιάζουμε δύο μοντέλα συλλογιστικής ανοικτών βαρών: gpt‑oss‑120b και gpt‑oss‑20b. Εκτελούνται σε υποδομή που ελέγχετε ή μέσω παρόχων φιλοξενίας.

Σημείωση: Αυτά τα μοντέλα δεν παρέχονται μέσω του OpenAI API και δεν είναι διαθέσιμα στο ChatGPT.

Γιατί ανοικτά βάρη

  • Επιλογή και έλεγχος: Εκτελέστε μοντέλα on‑premises ή στο ιδιωτικό σας cloud, διατηρήστε τη γεωγραφική διαμονή δεδομένων και προσαρμόστε την απόδοση στις ανάγκες σας.

  • Προσαρμογή: Ρυθμίστε λεπτομερώς ή προσαρμόστε τα μοντέλα με τα ανοικτά εργαλεία που προτιμάτε.

Διαθεσιμότητα και αδειοδότηση

  • Άδεια: Η Apache 2.0 επιτρέπει ευρεία χρήση, τροποποίηση και αναδιανομή, συμπεριλαμβανομένης της εμπορικής χρήσης (σύμφωνα με την πολιτική χρήσης gpt-oss μας).

  • Παροχή: Δεν είναι διαθέσιμο μέσω του OpenAI API, επομένως δεν ισχύουν η τιμολόγηση API και τα όρια ρυθμού.

  • Συμβατότητα: Μπορεί να εκτελεστεί με κοινές ανοικτές στοίβες inference όπως vLLM, Ollama, llama.cpp, καθώς και σε cloud ή αυτοδιαχειριζόμενα περιβάλλοντα GPU.

Ξεκινώντας

Για να αποκτήσετε τα βάρη του μοντέλου και τους συνοδευτικούς πόρους, μπορείτε να:

  • Επισκεφτείτε τον ιστότοπο του gpt-oss για μια επισκόπηση και άμεσους συνδέσμους.

  • Κατεβάσετε τα βάρη από τη συλλογή στο Hugging Face — έναν κοινοτικό κόμβο όπου μπορείτε να βρείτε και τα δύο μοντέλα, να δείτε παραδείγματα χρήσης και, προαιρετικά, να εκτελέσετε inference απευθείας μέσω των υπηρεσιών του Hugging Face.

  • Αποκτήσετε πρόσβαση στο αποθετήριό μας στο GitHub για κώδικα αναφοράς σχετικά με την εκτέλεση inference.

  • Χρησιμοποιήσετε τους οδηγούς στις Συνταγές OpenAI για τη ρύθμιση με υποστηριζόμενα περιβάλλοντα εκτέλεσης, όπως τα Ollama, vLLM και Transformers. Οι Συνταγές περιλαμβάνουν επίσης αναλυτικές οδηγίες για τοπική εκτέλεση, χρήση κοινών περιβαλλόντων εκτέλεσης και —όπου υποστηρίζεται— λεπτομερή ρύθμιση των μοντέλων gpt-oss.

gpt‑oss‑safeguard (ερευνητική προεπισκόπηση)

Το gpt‑oss‑safeguard είναι ένα ζεύγος μοντέλων συλλογιστικής για την ασφάλεια με ανοιχτά βάρη, τα οποία βασίζονται στο gpt‑oss. Έχουν σχεδιαστεί για ταξινόμηση ασφάλειας βάσει πολιτικής και συναφείς εργασίες εμπιστοσύνης & ασφάλειας, τις οποίες εκτελείτε σε υποδομή που ελέγχετε. Όπως και με άλλα μοντέλα gpt‑oss, αυτά τα βάρη δεν παρέχονται μέσω του OpenAI API ή του ChatGPT.

  • Μοντέλα μόνο για κείμενο με σχήματα αναφοράς για δομημένα αποτελέσματα (π.χ. απόφαση βάσει πολιτικής, αιτιολόγηση).

  • Χρησιμοποιήστε τη δική σας πολιτική: το μοντέλο ερμηνεύει τη γραπτή πολιτική σας, ώστε να μπορεί να γενικεύει σε διαφορετικά προϊόντα με ελάχιστη τεχνική εργασία.

  • Αποφάσεις μέσω συλλογιστικής: προαιρετικά ίχνη συλλογιστικής που διευκολύνουν τον εντοπισμό σφαλμάτων και τους ελέγχους (προορίζονται για προγραμματιστές και επαγγελματίες ασφάλειας, όχι για προβολή στους τελικούς χρήστες).

  • Ρυθμιζόμενη προσπάθεια συλλογιστικής: επιλέξτε επίπεδο Χαμηλό / Μεσαίο / Υψηλό, εξισορροπώντας την καθυστέρηση με το βάθος.

  • Άδεια χρήσης: Apache 2.0 (βλ. Διαθεσιμότητα και αδειοδότηση παρακάτω).

Το gpt‑oss‑safeguard είναι κατάλληλο για φιλτράρισμα εισόδου/εξόδου σε LLM, επισήμανση διαδικτυακού περιεχομένου και ροές εργασίας μαζικής επισήμανσης ή ελέγχου εκτός σύνδεσης. Για εφαρμογές γενικής χρήσης (συνομιλίες, πράκτορες κ.λπ.), συνιστούμε τα βασικά μοντέλα gpt‑oss.

Μπορείτε να προσαρμόσετε το σχήμα στις ανάγκες σας. Ανατρέξτε στο OpenAI Cookbook για οδηγούς σχετικά με τη σύνταξη προτροπών και για παραδείγματα.

Παραλλαγές μοντέλων & μεγέθη

ΜοντέλοΠροοριζόμενη χρήσηΣημειώσεις
gpt‑oss‑safeguard‑120bΧρήση παραγωγής, συλλογιστική ασφάλειας υψηλής χωρητικότητας117 δισ. παράμετροι (≈5,1 δισ. ενεργές). Σχεδιασμένο ώστε να χωρά σε

μία μόνο GPU 80 GB
(π.χ. NVIDIA H100· εκτελείται επίσης σε GPU με μεγαλύτερη μνήμη, όπως AMD MI300X).
gpt‑oss‑safeguard‑20bΠεριβάλλοντα χαμηλότερης καθυστέρησης / περιορισμένων πόρων21 δισ. παράμετροι (≈3,6 δισ. ενεργές).

Και τα δύο μοντέλα έχουν προσαρμοστεί από το gpt‑oss χωρίς αλλαγή αρχιτεκτονικής. Χρησιμοποιούν το ίδιο πρότυπο συνομιλίας με το gpt‑oss· μπορείτε να διατηρήσετε την υπάρχουσα ρύθμισή σας. Ένα προτεινόμενο μοτίβο προτροπής είναι να τοποθετήσετε την πολιτική σας σε μήνυμα προγραμματιστή και το περιεχόμενο προς αξιολόγηση σε μήνυμα χρήστη.

Υποστήριξη και κοινότητα

Οι αναπτύξεις ανοικτών βαρών είναι αυτοδιαχειριζόμενες και αυτοεξυπηρετούμενες. Δείτε πού μπορείτε να λάβετε υποστήριξη:

  • Ερωτήσεις, συζήτηση, συμβουλές: Χρησιμοποιήστε τις σελίδες μοντέλων του Hugging Face για να επικοινωνήσετε με την κοινότητα.

  • Αναπαραγώγιμα σφάλματα στον κώδικα αναφοράς inference της OpenAI: Ανοίξτε ένα issue στο αποθετήριο GitHub του gpt-oss.

  • Ζητήματα με runtime τρίτου μέρους (π.χ. vLLM, Ollama, llama.cpp): Χρησιμοποιήστε το σύστημα παρακολούθησης ζητημάτων, τα φόρουμ ή τη διαδικασία υποστήριξης του αντίστοιχου έργου.

Η OpenAI δεν παρέχει βοήθεια, πρακτική υλοποίηση ή υποστήριξη εντοπισμού σφαλμάτων για ρυθμίσεις, διαμορφώσεις, περιβάλλοντα ή εφαρμογές ανοικτών βαρών που φιλοξενούνται από εσάς ή από τρίτους.

Θα συνεχίσουμε να συνεργαζόμαστε με την κοινότητα για να βελτιώνουμε τα ανοικτά εργαλεία ασφάλειας, μεταξύ άλλων μέσω της ROOST Model Community (RMC). Η RMC φέρνει κοντά επαγγελματίες και ερευνητές ασφάλειας για να μοιράζονται βέλτιστες πρακτικές υλοποίησης μοντέλων TN ανοικτού κώδικα σε ροές εργασιών ασφάλειας, συμπεριλαμβανομένων αποτελεσμάτων αξιολόγησης και σχολίων για τα μοντέλα. Επισκεφθείτε το αποθετήριο GitHub της RMC για να μάθετε περισσότερα σχετικά με αυτήν τη συνεργασία και πώς να συμμετάσχετε.

Υποστήριξη και κοινότητα

Οι αναπτύξεις ανοικτών βαρών είναι αυτοδιαχειριζόμενες και αυτοεξυπηρετούμενες. Δείτε πού μπορείτε να λάβετε υποστήριξη:

  • Ερωτήσεις, συζήτηση, συμβουλές: Χρησιμοποιήστε τις σελίδες μοντέλων του Hugging Face για να επικοινωνήσετε με την κοινότητα.

  • Αναπαραγώγιμα σφάλματα στον κώδικα αναφοράς inference της OpenAI: Ανοίξτε ένα issue στο αποθετήριο GitHub του gpt-oss.

  • Ζητήματα με runtime τρίτου μέρους (π.χ. vLLM, Ollama, llama.cpp): Χρησιμοποιήστε το σύστημα παρακολούθησης ζητημάτων, τα φόρουμ ή τη διαδικασία υποστήριξης του αντίστοιχου έργου.

Η OpenAI δεν παρέχει βοήθεια, πρακτική υλοποίηση ή υποστήριξη εντοπισμού σφαλμάτων για ρυθμίσεις, διαμορφώσεις, περιβάλλοντα ή εφαρμογές ανοικτών βαρών που φιλοξενούνται από εσάς ή από τρίτους.

Απόρρητο και ασφάλεια

Απόρρητο και δεδομένα

Αυτά τα μοντέλα έχουν σχεδιαστεί για να εκτελούνται σε υποδομή που ελέγχετε (on-premises ή στο cloud σας ή σε συνεργάτη φιλοξενίας). Η OpenAI δεν λαμβάνει ούτε επεξεργάζεται τα δεδομένα που στέλνετε σε αυτά τα αυτοφιλοξενούμενα μοντέλα, εκτός αν τα κοινοποιήσετε ρητά στην OpenAI ή χρησιμοποιήσετε έναν από τους διαχειριζόμενους συνεργάτες φιλοξενίας μας.

Ασφάλεια

Αυτά τα μοντέλα υποβλήθηκαν σε εκτενή εκπαίδευση και δοκιμές ασφάλειας. Για περισσότερες λεπτομέρειες, δείτε την κάρτα μοντέλου και την τεχνική αναφορά μας.

Αναφορά παραβιάσεων περιεχομένου

Αν πιστεύετε ότι περιεχόμενο που δημιουργήθηκε με μοντέλα gpt‑oss παραβιάζει τις πολιτικές μας, μπορείτε να το αναφέρετε μέσω της φόρμας Αναφοράς περιεχομένου. Παρακαλούμε δώστε όσο το δυνατόν περισσότερες λεπτομέρειες για να βοηθήσετε την ομάδα μας να εξετάσει την υποβολή σας.

Συχνές ερωτήσεις

Είναι αυτά τα μοντέλα δωρεάν;

Τα βάρη του μοντέλου gpt-oss είναι δωρεάν για λήψη και χρήση βάσει της άδειας Apache 2.0 και της πολιτικής χρήσης του gpt-oss. Ωστόσο, εσείς είστε υπεύθυνοι για τυχόν κόστη που σχετίζονται με την εκτέλεσή τους — όπως υπολογιστική ισχύ, αποθήκευση ή χρεώσεις φιλοξενίας από τρίτους. Η τιμολόγησή τους θα εξαρτηθεί από την υποδομή ή τον πάροχο που θα επιλέξετε.

Είναι αυτά τα μοντέλα «ανοικτού κώδικα»;

Χρησιμοποιούμε τον όρο ανοικτά μοντέλα ή ανοικτών βαρών για να δείξουμε ότι τα εκπαιδευμένα βάρη είναι δημόσια διαθέσιμα με την επιτρεπτική άδεια Apache 2.0 και την πολιτική χρήσης gpt-oss. Αυτό σημαίνει ότι μπορείτε να κατεβάσετε τα μοντέλα, να τα εκτελέσετε στη δική σας υποδομή ή με υποστηριζόμενα πλαίσια φιλοξενίας και να τα προσαρμόσετε ή να τα ρυθμίσετε λεπτομερώς.

Τα ανοικτά μοντέλα προσφέρουν στους προγραμματιστές και στους οργανισμούς μεγαλύτερο έλεγχο και ευελιξία. Μπορείτε να επιλέξετε πού θα τα φιλοξενήσετε, να προσαρμόσετε τα μοντέλα για συγκεκριμένες περιπτώσεις χρήσης και να επωφεληθείτε από αδειοδότηση που επιτρέπει ευρεία χρήση, τροποποίηση και αναδιανομή. Παρότι τα εκπαιδευμένα βάρη είναι ανοικτά, ορισμένες γύρω υποδομές ή εργαλεία μπορεί να παραμένουν ιδιόκτητα στους παρόχους τους.

Μπορώ να αποκτήσω πρόσβαση σε αυτά τα μοντέλα μέσω του OpenAI API ή του ChatGPT;

Όχι. Αυτά τα μοντέλα δεν παρέχονται στο OpenAI API και δεν εμφανίζονται στο ChatGPT.

Μπορώ να ρυθμίσω λεπτομερώς τα μοντέλα;

Ναι. Μπορείτε να κάνετε λεπτομερή ρύθμιση χρησιμοποιώντας εργαλεία ανοικτού κώδικα και την υποδομή που προτιμάτε. Δεν προσφέρουμε λεπτομερή ρύθμιση μέσω των API της OpenAI για αυτά τα μοντέλα.

Είναι τα μοντέλα ανοικτών βαρών φθηνότερα από τη χρήση του API;

Το κόστος διαφέρει ανάλογα με την υποδομή, τον φόρτο εργασίας και την επιχειρησιακή προσέγγιση. Η αυτοφιλοξενία μπορεί να είναι φθηνότερη σε ορισμένες περιπτώσεις, ενώ η Πλατφόρμα API μας μπορεί να είναι πιο αποδοτική όταν συνυπολογίζονται η φιλοξενία, η συντήρηση και οι αναβαθμίσεις.

Ποιες δυνατότητες υποστηρίζουν αυτά τα μοντέλα;

Αυτά τα μοντέλα είναι προς το παρόν μοντέλα συλλογιστικής μόνο κειμένου. Τα κοινά runtime υποστηρίζουν streaming, κλήση λειτουργιών και δομημένα αποτελέσματα. Ελέγξτε την τεκμηρίωση του runtime σας για τις ακριβείς δυνατότητες.

Πώς διαφέρει αυτό από το ModAPI;

Πρόκειται για ένα εξαιρετικά ικανό μοντέλο συλλογιστικής που σας επιτρέπει να φέρετε τη δική σας πολιτική. Μπορεί να λειτουργεί παράλληλα με το ModAPI, αλλά πιθανότατα δεν αντικαθιστά περιπτώσεις χρήσης χαμηλής καθυστέρησης.

Σας βοήθησε αυτό το άρθρο;