OpenAI v zvezni državi Kaliforniji ponuja javno dostopne sisteme generativne AI. Te sisteme razvijamo z uporabo različnih virov podatkov, vključno z javno dostopnimi podatki, podatki, do katerih dostopamo v sodelovanju s tretjimi osebami, ter informacijami, ki jih zagotovijo ali ustvarijo naši uporabniki oziroma človeški trenerji in raziskovalci. Naše sisteme razvijamo tudi z uporabo sintetičnih podatkov.
Podatke uporabljamo za pomoč našim sistemom pri boljšem razumevanju človeškega jezika in sveta. To pa našim sistemom omogoča, da krepijo človeško ustvarjalnost, pospešujejo znanstvena odkritja in medicinske raziskave ter stotinam milijonov ljudi omogočajo izboljšanje vsakdanjega življenja. Naši sistemi so razviti na naborih podatkov, ki vsebujejo bilijone žetonov besedilne, slikovne, zvočne in avdiovizualne vsebine.
Za razvoj naših sistemov uporabljamo raznolik nabor podatkov, vključno s podatki, ki so lahko zaščiteni z avtorskimi pravicami, in podatki v javni domeni. Čeprav sprejemamo ukrepe za zmanjšanje količine osebnih podatkov v naših naborih podatkov za usposabljanje, lahko nekateri naši podatki vključujejo osebne podatke in združene informacije o potrošnikih, kot so opredeljeni v členu 1798.140 kalifornijskega civilnega zakonika. Naši uporabniki imajo možnost, da zavrnejo uporabo svoje vsebine za usposabljanje, ter da z uporabo našega Portala zasebnosti zahtevajo odstranitev določenih osebnih podatkov iz odgovorov ChatGPT. Za obdelavo naših naborov podatkov uporabljamo različne tehnike, da izboljšamo zmogljivost in natančnost naših modelov.
Podatke za razvoj naših sistemov smo začeli zbirati približno leta 2018 in jih zbiramo še danes. Naše nabore podatkov smo za razvoj sistemov prvič uporabili leta 2021.
Dodatne informacije o razvoju naših sistemov so na voljo v naših sistemskih dokumentih.
Povzetek učnih podatkov v skladu z oddelkom 3111 Civilnega zakonika Kalifornije
Posodobljeno: 7 days ago
