Kumbuka: Makala haya yanatoa muhtasari wa kiwango cha juu. Taarifa za usanidi wa kiufundi zinapatikana kwenye tovuti ya gpt-oss, GitHub, Hugging Face, na OpenAI Cookbooks.
Muhtasari
Tunatambulisha miundo miwili ya uwazaji yenye uzani huria: gpt‑oss‑120b na gpt‑oss‑20b. Inaendeshwa kwenye miundombinu unayodhibiti, au kupitia watoa huduma za upangishaji.
Kumbuka: Miundo hii haitolewi kupitia OpenAI API na haipatikani kwenye ChatGPT.
Kwa nini uzani huria
Chaguo na udhibiti: Endesha miundo kwenye majengo yako au katika wingu lako binafsi, dumisha hifadhi ya data, na rekebisha utendaji kulingana na mahitaji yako.
Ubinafsishaji: Fanya fine-tuning au rekebisha miundo kwa zana huria unazopendelea.
Upatikanaji na leseni
Leseni: Apache 2.0 inaruhusu matumizi mapana, marekebisho, na usambazaji upya, ikijumuisha matumizi ya kibiashara (kwa kuzingatia sera yetu ya matumizi ya gpt-oss).
Utoaji huduma: Haipatikani kupitia OpenAI API, kwa hivyo bei za API na vikomo vya maombi havitumiki.
Uoanifu: Inaweza kuendeshwa na mifumo ya kawaida ya wazi ya inference kama vLLM, Ollama, llama.cpp, na kwenye mazingira ya GPU ya wingu au yanayosimamiwa na mtumiaji mwenyewe.
Kuanza
Ili kupata uzani wa muundo na nyenzo za usaidizi, unaweza:
Tembelea tovuti ya gpt-oss kwa muhtasari na viungo vya moja kwa moja.
Pakua uzani kutoka mkusanyiko wa Hugging Face — kitovu cha jumuiya ambapo unaweza kupata miundo yote miwili, kuona mifano ya matumizi, na kwa hiari kuendesha inference moja kwa moja kupitia huduma za Hugging Face.
Fikia hazina yetu ya GitHub kwa msimbo wa marejeleo wa inference.
Tumia miongozo katika OpenAI Cookbook kwa usanidi na mazingira ya utekelezaji yanayotumika kama Ollama, vLLM, na Transformers. Cookbook pia inajumuisha maelekezo ya hatua kwa hatua ya kuendesha kwa ndani, kutumia mazingira ya kawaida ya utekelezaji, na—panapotumika—kufanya fine-tuning ya miundo ya gpt‑oss.
gpt‑oss‑safeguard (hakikisho la utafiti)
gpt‑oss‑safeguard ni jozi ya miundo ya uwazaji wa usalama yenye uzani huria iliyojengwa juu ya gpt‑oss. Imeundwa kwa ajili ya uainishaji wa usalama unaotegemea sera na majukumu yanayohusiana ya uaminifu na usalama unayoendesha kwenye miundombinu unayodhibiti. Kama miundo mingine ya gpt‑oss, uzani huu hautolewi kupitia OpenAI API au ChatGPT.
Miundo ya maandishi pekee yenye vielezo vya marejeleo vya matokeo yaliyopangwa (mf., uamuzi wa sera, mantiki).
Leta sera yako mwenyewe: muundo hufasiri sera yako iliyoandikwa ili iweze kujumuisha bidhaa mbalimbali kwa uhandisi mdogo.
Maamuzi yenye uwazaji: nyayo za hiari za uwazaji kusaidia utatuzi na ukaguzi (zinazokusudiwa kwa wasanidi programu na wataalamu wa usalama, si kuonyeshwa kwa watumiaji wa mwisho).
Juhudi ya uwazaji inayoweza kusanidiwa: chagua chini / wastani / juu ili kubadilishana kati ya ucheleweshaji na kina.
Leseni: Apache 2.0 (tazama Upatikanaji na leseni hapa chini).
gpt‑oss‑safeguard inafaa kwa uchujaji wa ingizo/tokeo kwa LLM, uwekaji lebo wa maudhui mtandaoni, na mtiririko wa kazi wa kuweka lebo au kukagua makundi nje ya mtandao. Kwa programu za jumla (gumzo, mawakala, n.k.), tunapendekeza miundo msingi ya gpt‑oss.
Unaweza kubadilisha kielezo kulingana na mahitaji yako. Tafadhali rejelea OpenAI Cookbook kwa miongozo kuhusu udokezaji na mifano.
Aina za miundo na ukubwa
| Muundo | Matumizi yaliyokusudiwa | Madokezo |
|---|---|---|
| gpt‑oss‑safeguard‑120b | Uzalishaji, uwazaji wa usalama wa uwezo wa juu | Vigezo 117B (≈5.1B vinavyotumika). Imeundwa kutoshea kwenye GPU moja ya 80 GB (mf., NVIDIA H100; pia huendeshwa kwenye GPU zenye kumbukumbu kubwa zaidi kama AMD MI300X). |
| gpt‑oss‑safeguard‑20b | Mazingira ya ucheleweshaji mdogo / yenye vikwazo | Vigezo 21B (≈3.6B vinavyotumika). |
Miundo yote miwili imefanyiwa fine-tuning kutoka gpt‑oss bila mabadiliko ya usanifu. Inatumia kiolezo sawa cha gumzo kama gpt‑oss; unaweza kubaki na usanidi wako uliopo. Mchoro unaopendekezwa wa udokezaji ni kuweka sera yako katika ujumbe wa msanidi programu na maudhui ya kutathmini katika ujumbe wa mtumiaji.
Usaidizi na jumuiya
Usambazaji wa uzani huria unasimamiwa na kuhudumiwa na watumiaji wenyewe. Hapa ndipo pa kupata usaidizi:
Maswali, majadiliano, vidokezo: Tumia kurasa za miundo za Hugging Face kushirikiana na jumuiya.
Hitilafu zinazoweza kurudiwa katika msimbo wa marejeleo wa inference wa OpenAI: Fungua suala kwenye hazina ya GitHub ya gpt-oss.
Matatizo ya mazingira ya utekelezaji ya mhusika wa tatu (mf., vLLM, Ollama, llama.cpp): Tumia kifuatiliaji cha masuala, mijadala, au mchakato wa usaidizi wa mradi husika.
OpenAI haitoi msaada, utekelezaji wa moja kwa moja, au usaidizi wa utatuzi kwa usanidi, mipangilio, mazingira, au programu zozote za uzani huria zinazopangishwa na mtumiaji mwenyewe au na mhusika wa tatu.
Tutaendelea kushirikiana na jumuiya kuboresha zana huria za usalama, ikiwemo kupitia ROOST Model Community (RMC). RMC huwaleta pamoja wataalamu na watafiti wa usalama ili kushiriki mbinu bora za kutekeleza miundo ya AI ya chanzo huria katika mitiririko ya kazi ya usalama, ikijumuisha matokeo ya tathmini na maoni kuhusu muundo. Tembelea hazina ya GitHub ya RMC ili kujifunza zaidi kuhusu ushirikiano huu na jinsi ya kushiriki.
Usaidizi na jumuiya
Usambazaji wa uzani huria unasimamiwa na kuhudumiwa na watumiaji wenyewe. Hapa ndipo pa kupata usaidizi:
Maswali, majadiliano, vidokezo: Tumia kurasa za miundo za Hugging Face kushirikiana na jumuiya.
Hitilafu zinazoweza kurudiwa katika msimbo wa marejeleo wa inference wa OpenAI: Fungua suala kwenye hazina ya GitHub ya gpt-oss.
Matatizo ya mazingira ya utekelezaji ya mhusika wa tatu (mf., vLLM, Ollama, llama.cpp): Tumia kifuatiliaji cha masuala, mijadala, au mchakato wa usaidizi wa mradi husika.
OpenAI haitoi msaada, utekelezaji wa moja kwa moja, au usaidizi wa utatuzi kwa usanidi, mipangilio, mazingira, au programu zozote za uzani huria zinazopangishwa na mtumiaji mwenyewe au na mhusika wa tatu.
Faragha na usalama
Faragha na data
Miundo hii imeundwa kuendeshwa kwenye miundombinu unayodhibiti (kwenye majengo yako au katika wingu lako au kwa mshirika wako wa upangishaji). OpenAI haipokei wala kuchakata data unayotuma kwa miundo hii unayojipangishia isipokuwa uiwasilishe kwa OpenAI waziwazi, au utumie mmoja wa washirika wetu wa upangishaji unaosimamiwa.
Usalama
Miundo hii ilipitia mafunzo na majaribio ya kina ya usalama. Kwa maelezo zaidi, angalia kadi ya muundo na ripoti ya kiufundi yetu.
Kuripoti ukiukaji wa maudhui
Ikiwa unaamini maudhui yaliyotengenezwa kwa miundo ya gpt‑oss yanakiuka sera zetu, unaweza kuyaripoti kupitia fomu yetu ya Kuripoti Maudhui. Tafadhali toa maelezo mengi iwezekanavyo ili kusaidia timu yetu kukagua wasilisho lako.
Maswali Yanayoulizwa Mara kwa Mara
Je, miundo hii ni ya bila malipo?
Uzani wa muundo wa gpt-oss unaweza kupakuliwa na kutumiwa bila malipo chini ya leseni ya Apache 2.0 na sera ya matumizi ya gpt-oss. Hata hivyo, unawajibika kwa gharama zozote zinazohusiana na kuiendesha — kama vile kompyuta, hifadhi, au ada za upangishaji za wahusika wa tatu. Bei za hayo zitategemea miundombinu au mtoa huduma uliomchagua.
Je, miundo hii ni “chanzo huria”?
Tunatumia istilahi open models au uzani huria kuonyesha kuwa uzani uliofunzwa unapatikana hadharani chini ya leseni ruhusu ya Apache 2.0 na sera ya matumizi ya gpt-oss. Hii inamaanisha unaweza kupakua miundo, kuiendesha kwenye miundombinu yako mwenyewe au kwa mifumo ya upangishaji inayotumika, na kuibinafsisha au kuifanyia fine-tuning.
Open models huwapa wasanidi programu na mashirika udhibiti na unyumbufu zaidi. Unaweza kuchagua mahali pa kupangisha, kurekebisha miundo kwa matumizi mahususi, na kunufaika na leseni inayoruhusu matumizi mapana, marekebisho, na usambazaji upya. Ingawa uzani uliofunzwa uko wazi, baadhi ya miundombinu au zana zinazoizunguka zinaweza kubaki miliki ya watoa huduma wake.
Je, ninaweza kufikia miundo hii kupitia OpenAI API au ChatGPT?
La. Miundo hii haitolewi katika OpenAI API na haionekani katika ChatGPT.
Je, ninaweza kufanya fine-tuning ya miundo?
Ndiyo. Unaweza kufanya fine-tuning kwa kutumia zana za chanzo huria na miundombinu unayopendelea. Hatutoi fine-tuning kupitia API za OpenAI kwa miundo hii.
Je, miundo ya uzani huria ni nafuu kuliko kutumia API?
Gharama hutofautiana kulingana na miundombinu, mzigo wa kazi, na mbinu ya uendeshaji. Kujipangishia kunaweza kuwa nafuu katika baadhi ya hali, ilhali API Platform yetu inaweza kuwa bora zaidi ukizingatia upangishaji, matengenezo, na masasisho.
Miundo hii inaauni vipengele gani?
Kwa sasa miundo hii ni miundo ya uwazaji ya maandishi pekee. Mazingira ya kawaida ya utekelezaji yanaauni utiririshaji, mgao wa kiutendaji, na matokeo yaliyopangwa. Angalia nyaraka za mazingira yako ya utekelezaji kwa uwezo halisi.
Hii inatofautianaje na ModAPI?
Huu ni muundo wa uwazaji wenye uwezo mkubwa unaokuruhusu kuleta sera yako mwenyewe. Unaweza kufanya kazi pamoja na ModAPI lakini huenda usiwe mbadala kwa matumizi yanayohitaji ucheleweshaji mdogo.
