Напомена: Оваа статија дава преглед на високо ниво. Информации за техничко поставување може да се најдат на веб-страницата на gpt-oss, GitHub, Hugging Face и OpenAI Cookbooks.
Преглед
Ви претставуваме два модела со расудување со отворени тежини: gpt‑oss‑120b и gpt‑oss‑20b. Тие работат на инфраструктура што ја контролирате или преку даватели на хостинг.
Забелешка: Овие модели не се сервираат преку OpenAI API и не се достапни во ChatGPT.
Зошто отворени тежини
Избор и контрола: Извршувајте модели локално или во вашиот приватен облак, задржете го местото на чување на податоците и приспособете ги перформансите според вашите потреби.
Приспособување: Фино нагодувајте или приспособувајте ги моделите со вашите претпочитани отворени алатки.
Достапност и лиценцирање
Лиценца: Apache 2.0 дозволува широка употреба, модификација и редистрибуција, вклучително и комерцијална употреба (предмет на нашата политика за користење на gpt-oss).
Служење: Не е достапно преку OpenAI API, па цените и ограничувањата на брзината за API не важат.
Компатибилност: Може да се извршува со вообичаени отворени стекови за инференција како vLLM, Ollama, llama.cpp, како и во облак или самостојно управувани GPU околини.
Како да започнете
За да ги добиете тежините на моделот и придружните ресурси, можете:
Посетете ја веб-локацијата на gpt-oss за преглед и директни врски.
Преземете ги тежините од колекцијата на Hugging Face — центар на заедницата каде што можете да ги најдете двата модела, да погледнете примери за употреба и, по избор, да извршите инференција директно преку услугите на Hugging Face.
Пристапете до нашето складиште на GitHub за референтен код за инференција.
Користете ги водичите во Рецептите на OpenAI за поставување со поддржани извршни околини како Ollama, vLLM и Transformers. Рецептите содржат и детални упатства за локално извршување, користење вообичаени извршни околини и, каде што е поддржано, фино приспособување на моделите gpt-oss.
gpt‑oss‑safeguard (истражувачка верзија за преглед)
gpt‑oss‑safeguard е пар безбедносни модели со расудување и отворени тежини, изградени врз gpt‑oss. Тие се наменети за класификација на безбедноста врз основа на политики и сродни задачи за доверба & безбедност што ги извршувате на инфраструктура под ваша контрола. Како и кај другите gpt‑oss модели, овие тежини не се достапни преку OpenAI API или ChatGPT.
Модели само за текст со референтни шеми за структурирани резултати (на пр., одлука според политиката, образложение).
Користете сопствена политика: моделот ја толкува вашата пишана политика за да може да се применува на различни производи со минимален инженерски ангажман.
Образложени одлуки: изборни траги од расудувањето што помагаат при отстранување грешки и ревизии (наменети за програмери и стручњаци за безбедност, а не за прикажување на крајните корисници).
Приспособлив напор за расудување: изберете Ниска / Средна / Висока за да постигнете рамнотежа меѓу доцнењето и длабочината.
Лиценца: Apache 2.0 (видете Достапност и лиценцирање подолу).
gpt‑oss‑safeguard е соодветен за филтрирање на влезните и излезните податоци кај LLM, означување онлајн содржини и работни текови за офлајн групно означување или преглед. За општи примени (разговори, агенти итн.) ги препорачуваме основните gpt‑oss модели.
Може да ја приспособите шемата на вашите потреби. Видете го OpenAI Cookbook за водичи и примери за задавање инструкции.
Варијанти и големини на модели
| Модел | Наменета употреба | Белешки |
|---|---|---|
| gpt‑oss‑safeguard‑120b | Продукциско безбедносно расудување со висок капацитет | 117B параметри (≈5.1B активни). Дизајниран да се вклопи на еден GPU од 80 GB (на пр., NVIDIA H100; работи и на GPU со поголема меморија, како AMD MI300X). |
| gpt‑oss‑safeguard‑20b | Средини со помала латентност / ограничени средини | 21B параметри (≈3.6B активни). |
Двата модела се фино нагодени од gpt‑oss без промена на архитектурата. Тие го користат истиот шаблон за разговор како gpt‑oss; можете да ја задржите постојната поставка. Препорачан образец за промптување е да ја ставите вашата политика во порака од програмер, а содржината за оценување во корисничка порака.
Поддршка и заедница
Внедрувањата со отворени тежини се самостојно управувани и самостојно сервисирани. Еве каде може да добиете поддршка:
Прашања, дискусија, совети: Користете ги страниците на моделите на Hugging Face за да се вклучите во заедницата.
Репродуцибилни грешки во референтниот код за инференција на OpenAI: Отворете проблем во репозиториумот на GitHub за gpt-oss.
Проблеми со извршна околина од трета страна (на пр., vLLM, Ollama, llama.cpp): Користете го следачот на проблеми, форумите или процесот за поддршка на соодветниот проект.
OpenAI не обезбедува помош, практична имплементација или поддршка за отстранување грешки за какви било самостојно хостирани или од трета страна хостирани поставки, конфигурации, околини или апликации со отворени тежини.
Ќе продолжиме да соработуваме со заедницата за да ги подобриме отворените алатки за безбедност, вклучително и преку ROOST Model Community (RMC). RMC ги обединува практичарите и истражувачите за безбедност за да споделуваат најдобри практики за имплементирање модели со вештачка интелигенција со отворен код во безбедносни работни текови, вклучувајќи резултати од евалуации и повратни информации за моделите. Посетете го репозиториумот на GitHub на RMC за да дознаете повеќе за ова партнерство и како да се вклучите.
Поддршка и заедница
Внедрувањата со отворени тежини се самостојно управувани и самостојно сервисирани. Еве каде може да добиете поддршка:
Прашања, дискусија, совети: Користете ги страниците на моделите на Hugging Face за да се вклучите во заедницата.
Репродуцибилни грешки во референтниот код за инференција на OpenAI: Отворете проблем во репозиториумот на GitHub за gpt-oss.
Проблеми со извршна околина од трета страна (на пр., vLLM, Ollama, llama.cpp): Користете го следачот на проблеми, форумите или процесот за поддршка на соодветниот проект.
OpenAI не обезбедува помош, практична имплементација или поддршка за отстранување грешки за какви било самостојно хостирани или од трета страна хостирани поставки, конфигурации, околини или апликации со отворени тежини.
Приватност и безбедност
Приватност и податоци
Овие модели се дизајнирани да работат на инфраструктура што ја контролирате (локално или во вашиот облак или кај партнер за хостирање). OpenAI не ги прима ниту ги обработува податоците што ги испраќате до овие самостојно хостирани модели, освен ако изречно не ги споделите со OpenAI или не користите некој од нашите управувани партнери за хостирање.
Безбедност
Овие модели поминаа низ обемна обука и тестирање за безбедност. За повеќе детали, погледнете ја нашата картичка на моделот и техничкиот извештај.
Пријавување прекршувања на содржина
Ако сметате дека содржина генерирана со моделите gpt‑oss ги прекршува нашите политики, можете да ја пријавите преку нашиот образец за пријавување содржина. Ве молиме наведете што е можно повеќе детали за да му помогнете на нашиот тим да ја прегледа вашата пријава.
ЧПП
Дали овие модели се бесплатни?
Тежините на моделот gpt-oss се бесплатни за преземање и користење според лиценцата Apache 2.0 и политиката за користење на gpt-oss. Сепак, вие сте одговорни за сите трошоци поврзани со нивното извршување — како што се трошоци за пресметување, складирање или хостирање од трети страни. Цените за нив ќе зависат од избраната инфраструктура или давател.
Дали овие модели се „со отворен код“?
Ги користиме термините јавни модели или со отворени тежини за да укажеме дека обучените тежини се јавно достапни под дозволивата лиценца Apache 2.0 и политиката за користење на gpt-oss. Ова значи дека можете да ги преземете моделите, да ги извршувате на сопствена инфраструктура или со поддржани рамки за хостирање, и да ги приспособувате или фино нагодувате.
Јавните модели им даваат на програмерите и организациите поголема контрола и флексибилност. Можете да изберете каде ќе хостирате, да ги приспособите моделите за конкретни случаи на употреба и да имате корист од лиценцирање што овозможува широка употреба, модификација и редистрибуција. Иако обучените тежини се отворени, дел од околната инфраструктура или алатки може да останат сопственички на нивните даватели.
Може ли да пристапам до овие модели преку OpenAI API или ChatGPT?
Не. Овие модели не се служат во OpenAI API и не се појавуваат во ChatGPT.
Може ли фино да ги нагодувам моделите?
Да. Можете да вршите фино нагодување со алатки со отворен код и вашата претпочитана инфраструктура. Не нудиме фино нагодување преку OpenAI API за овие модели.
Дали моделите со отворени тежини се поевтини од користењето на API?
Трошоците варираат според инфраструктурата, работното оптоварување и оперативниот пристап. Самостојното хостирање може да биде поевтино во некои случаи, додека нашата API Platform може да биде поефикасна кога ќе се земат предвид хостирањето, одржувањето и надградбите.
Кои функции ги поддржуваат овие модели?
Овие модели во моментов се модели со расудување само за текст. Вообичаените извршни околини поддржуваат стриминг, повикување на функција и структурирани резултати. Проверете ја документацијата на вашата извршна околина за точните можности.
По што се разликува ова од ModAPI?
Ова е многу способен модел со расудување што ви овозможува да донесете своја политика. Може да работи заедно со ModAPI, но веројатно не е замена за случаи на употреба со ниска латентност.
