OpenAI
Šo lapu tulkoja mašīntulks. Skatīt oriģinālo rakstu angļu valodā.

Mācību datu kopsavilkums saskaņā ar Kalifornijas Civilkodeksa 3111. pantu

Atjaunināts: 7 days ago

OpenAI Kalifornijas štatā piedāvā publiski pieejamas ģeneratīvās AI sistēmas. Mēs izstrādājam šīs sistēmas, izmantojot dažādus datu avotus, tostarp publiski pieejamus datus, datus, kuriem piekļūstam sadarbībā ar trešajām pusēm, un informāciju, ko sniedz vai ģenerē mūsu lietotāji vai cilvēki-treneri un pētnieki. Mēs arī izstrādājam savas sistēmas, izmantojot sintētiskos datus.

Mēs izmantojam datus, lai palīdzētu mūsu sistēmām labāk izprast cilvēku valodu un pasauli. Tas savukārt ļauj mūsu sistēmām veicināt cilvēku radošumu, sekmēt zinātniskos atklājumus un medicīniskos pētījumus, kā arī palīdzēt simtiem miljonu cilvēku uzlabot ikdienas dzīvi. Mūsu sistēmas tiek izstrādātas, izmantojot datu kopas, kas satur triljoniem tekstvienību teksta, attēlu, audio un audiovizuālā satura.

Mēs savu sistēmu izstrādei izmantojam daudzveidīgu datu kopumu, tostarp datus, kurus var aizsargāt autortiesības, un publiskā domēna datus. Lai gan mēs veicam pasākumus, lai samazinātu personiskās informācijas apjomu mūsu apmācības datu kopās, daži mūsu dati var ietvert personisko informāciju un apkopotu patērētāju informāciju, kā definēts Kalifornijas Civilkodeksa 1798.140. sadaļā. Mūsu lietotājiem ir iespēja atteikties no sava satura izmantošanas apmācībā, kā arī pieprasīt konkrētas personiskās informācijas noņemšanu no ChatGPT atbildēm, izmantojot mūsu Privātuma portālu. Mēs izmantojam dažādas metodes, lai apstrādātu savas datu kopas un uzlabotu mūsu modeļu veiktspēju un precizitāti.

Mēs sākām vākt datus savu sistēmu izstrādei aptuveni 2018. gadā, un turpinām vākt datus arī šodien. Mēs pirmo reizi izmantojām savas datu kopas sistēmu izstrādei 2021. gadā.

Papildu informācija par mūsu sistēmu izstrādi ir atrodama mūsu sistēmas kartēs.

Vai šis raksts bija noderīgs?