OpenAI
Halaman ini diterjemah oleh mesin. Lihat artikel asal dalam bahasa Inggeris.

Model wajaran terbuka OpenAI (gpt-oss)

Ketahui tentang model wajaran terbuka OpenAI (gpt-oss) dan tempat mendapatkan sokongan

Dikemas kini: 7 days ago

Nota: Artikel ini memberikan gambaran keseluruhan peringkat tinggi. Maklumat untuk persediaan teknikal boleh didapati di laman web gpt-oss, GitHub, Hugging Face, dan OpenAI Cookbooks.

Gambaran keseluruhan

Memperkenalkan dua model penaakulan wajaran terbuka: gpt‑oss‑120b dan gpt‑oss‑20b. Model ini berjalan pada infrastruktur yang anda kawal, atau melalui penyedia pengehosan.

Nota: Model ini tidak disediakan melalui OpenAI API dan tidak tersedia dalam ChatGPT.

Mengapa wajaran terbuka

  • Pilihan dan kawalan: Jalankan model di premis atau dalam awan peribadi anda, kekalkan residensi data dan sesuaikan prestasi mengikut keperluan anda.

  • Penyesuaian: Tala halus atau sesuaikan model dengan alat terbuka pilihan anda.

Ketersediaan dan pelesenan

  • Lesen: Apache 2.0 membenarkan penggunaan, pengubahsuaian dan pengedaran semula yang luas, termasuk penggunaan komersial (tertakluk pada dasar penggunaan gpt-oss kami).

  • Penyajian: Tidak tersedia melalui OpenAI API, jadi harga API dan had kadar tidak terpakai.

  • Keserasian: Boleh dijalankan dengan tindanan inferens terbuka yang lazim seperti vLLM, Ollama, llama.cpp, serta pada persekitaran GPU awan atau yang diurus sendiri.

Bermula

Untuk mendapatkan wajaran model dan sumber sokongan, anda boleh:

  • Lawati laman web gpt-oss untuk gambaran keseluruhan dan pautan terus.

  • Muat turun wajaran daripada koleksi Hugging Face — hab komuniti tempat anda boleh menemukan kedua-dua model, melihat contoh penggunaan dan, jika mahu, menjalankan inferens secara terus melalui perkhidmatan Hugging Face.

  • Akses repo GitHub kami untuk kod inferens rujukan.

  • Gunakan panduan dalam OpenAI Cookbook untuk persediaan dengan runtime yang disokong seperti Ollama, vLLM dan Transformers. Cookbook juga merangkumi arahan langkah demi langkah untuk menjalankan secara setempat, menggunakan runtime lazim dan—jika disokong—menala halus model gpt‑oss.

gpt‑oss‑safeguard (pratonton penyelidikan)

gpt‑oss‑safeguard ialah sepasang model penaakulan keselamatan wajaran terbuka yang dibina di atas gpt‑oss. Model ini direka untuk pengelasan keselamatan berasaskan dasar dan tugasan kepercayaan & keselamatan berkaitan yang anda jalankan pada infrastruktur yang anda kawal. Seperti model gpt‑oss lain, wajaran ini tidak disediakan melalui OpenAI API atau ChatGPT.

  • Model teks sahaja dengan skema output berstruktur rujukan (cth., keputusan dasar, rasional).

  • Bawa dasar anda sendiri: model mentafsir dasar bertulis anda supaya ia boleh membuat generalisasi merentas produk dengan kejuruteraan yang minimum.

  • Keputusan bersebab: jejak penaakulan pilihan untuk membantu penyahpepijatan dan audit (ditujukan untuk pembangun dan pengamal keselamatan, bukan untuk paparan kepada pengguna akhir).

  • Usaha penaakulan boleh dikonfigurasi: pilih rendah / sederhana / tinggi untuk mengimbangi kependaman dengan kedalaman.

  • Lesen: Apache 2.0 (lihat Ketersediaan dan pelesenan di bawah).

gpt‑oss‑safeguard sesuai untuk penapisan input/output bagi LLM, pelabelan kandungan dalam talian, serta aliran kerja pelabelan atau semakan kelompok luar talian. Untuk aplikasi umum (sembang, ejen, dsb.), kami mengesyorkan model gpt‑oss teras.

Anda boleh menyesuaikan skema mengikut keperluan anda. Sila rujuk OpenAI Cookbook untuk panduan tentang prompting dan contoh.

Varian model & saiz

ModelPenggunaan yang dimaksudkanNota
gpt‑oss‑safeguard‑120bPenaakulan keselamatan berkapasiti tinggi untuk produksi117B parameter (≈5.1B aktif). Direka untuk muat pada

satu GPU 80 GB
(cth., NVIDIA H100; juga berjalan pada GPU bermemori lebih besar seperti AMD MI300X).
gpt‑oss‑safeguard‑20bKependaman lebih rendah / persekitaran terhad21B parameter (≈3.6B aktif).

Kedua-dua model ditala halus daripada gpt‑oss tanpa perubahan seni bina. Model ini menggunakan templat sembang yang sama seperti gpt‑oss; anda boleh mengekalkan persediaan sedia ada. Corak prompting yang disyorkan ialah meletakkan dasar anda dalam mesej pembangun dan kandungan untuk dinilai dalam mesej pengguna.

Sokongan dan komuniti

Pengerahan wajaran terbuka diurus dan disokong sendiri. Berikut ialah tempat untuk mendapatkan sokongan:

  • Soalan, perbincangan, petua: Gunakan halaman model Hugging Face untuk berinteraksi dengan komuniti.

  • Pepijat yang boleh dihasilkan semula dalam kod inferens rujukan OpenAI: Buka isu dalam repo GitHub gpt-oss.

  • Isu dengan runtime pihak ketiga (cth., vLLM, Ollama, llama.cpp): Gunakan penjejak isu, forum atau proses sokongan projek masing-masing.

OpenAI tidak menyediakan bantuan, pelaksanaan secara langsung atau sokongan penyahpepijatan untuk sebarang persediaan, konfigurasi, persekitaran atau aplikasi wajaran terbuka yang dihos sendiri atau dihos pihak ketiga.

Kami akan terus beriterasi bersama komuniti untuk menambah baik alat keselamatan terbuka, termasuk melalui ROOST Model Community (RMC). RMC menghimpunkan pengamal dan penyelidik keselamatan untuk berkongsi amalan terbaik bagi melaksanakan model AI sumber terbuka dalam aliran kerja keselamatan, termasuk hasil penilaian dan maklum balas model. Lawati repo GitHub RMC untuk mengetahui lebih lanjut tentang perkongsian ini dan cara untuk terlibat.

Sokongan dan komuniti

Pengerahan wajaran terbuka diurus dan disokong sendiri. Berikut ialah tempat untuk mendapatkan sokongan:

  • Soalan, perbincangan, petua: Gunakan halaman model Hugging Face untuk berinteraksi dengan komuniti.

  • Pepijat yang boleh dihasilkan semula dalam kod inferens rujukan OpenAI: Buka isu dalam repo GitHub gpt-oss.

  • Isu dengan runtime pihak ketiga (cth., vLLM, Ollama, llama.cpp): Gunakan penjejak isu, forum atau proses sokongan projek masing-masing.

OpenAI tidak menyediakan bantuan, pelaksanaan secara langsung atau sokongan penyahpepijatan untuk sebarang persediaan, konfigurasi, persekitaran atau aplikasi wajaran terbuka yang dihos sendiri atau dihos pihak ketiga.

Privasi dan keselamatan

Privasi dan data

Model ini direka untuk berjalan pada infrastruktur yang anda kawal (di premis atau dalam awan anda atau rakan kongsi pengehosan anda). OpenAI tidak menerima atau memproses data yang anda hantar kepada model yang dihos sendiri ini melainkan anda berkongsi data tersebut secara jelas dengan OpenAI, atau menggunakan salah satu rakan kongsi pengehosan terurus kami.

Keselamatan

Model ini telah menjalani latihan dan ujian keselamatan yang meluas. Untuk butiran lanjut, lihat kad model dan laporan teknikal kami.

Melaporkan pelanggaran kandungan

Jika anda percaya kandungan yang dijana dengan model gpt‑oss melanggar dasar kami, anda boleh melaporkannya melalui borang Lapor Kandungan kami. Sila berikan butiran sebanyak mungkin untuk membantu pasukan kami menyemak penyerahan anda.

Soalan Lazim

Adakah model ini percuma?

Wajaran model gpt-oss boleh dimuat turun dan digunakan secara percuma di bawah lesen Apache 2.0 dan dasar penggunaan gpt-oss. Walau bagaimanapun, anda bertanggungjawab terhadap sebarang kos yang berkaitan dengan menjalankannya — seperti kos pengkomputeran, storan atau pengehosan pihak ketiga. Harga untuk perkara tersebut bergantung pada infrastruktur atau penyedia yang anda pilih.

Adakah model ini “sumber terbuka”?

Kami menggunakan istilah model terbuka atau wajaran terbuka untuk menunjukkan bahawa wajaran terlatih tersedia secara umum di bawah lesen Apache 2.0 yang permisif dan dasar penggunaan gpt-oss. Ini bermakna anda boleh memuat turun model, menjalankannya pada infrastruktur anda sendiri atau dengan rangka kerja pengehosan yang disokong, serta menyesuaikan atau menala halus model tersebut.

Model terbuka memberi pembangun dan organisasi lebih kawalan dan fleksibiliti. Anda boleh memilih tempat untuk mengehos, menyesuaikan model bagi kes penggunaan tertentu dan mendapat manfaat daripada pelesenan yang membenarkan penggunaan, pengubahsuaian dan pengedaran semula yang luas. Walaupun wajaran terlatih adalah terbuka, sesetengah infrastruktur atau alat di sekelilingnya mungkin kekal proprietari kepada penyedia masing-masing.

Bolehkah saya mengakses model ini melalui OpenAI API atau ChatGPT?

Tidak. Model ini tidak disediakan dalam OpenAI API dan tidak muncul dalam ChatGPT.

Bolehkah saya menala halus model ini?

Ya. Anda boleh menala halus menggunakan alat sumber terbuka dan infrastruktur pilihan anda. Kami tidak menawarkan penalaan halus melalui OpenAI API untuk model ini.

Adakah model wajaran terbuka lebih murah daripada menggunakan API?

Kos berbeza-beza bergantung pada infrastruktur, beban kerja dan pendekatan operasi. Pengehosan sendiri mungkin lebih murah dalam sesetengah keadaan, manakala Platform API kami mungkin lebih cekap apabila mengambil kira pengehosan, penyelenggaraan dan naik taraf.

Apakah ciri yang disokong oleh model ini?

Model ini pada masa ini ialah model penaakulan teks sahaja. Runtime lazim menyokong penstriman, panggilan fungsi dan output berstruktur. Semak dokumentasi runtime anda untuk keupayaan yang tepat.

Apakah bezanya dengan ModAPI?

Ini ialah model penaakulan berkeupayaan tinggi yang membolehkan anda membawa dasar anda sendiri. Ia boleh berfungsi seiring dengan ModAPI tetapi berkemungkinan bukan pengganti untuk kes penggunaan berkependaman rendah.

Adakah artikel ini membantu?