OpenAI Калифорния штатында жалпыға қолжетімді генеративті AI жүйелерін ұсынады. Біз бұл жүйелерді әртүрлі дерек көздерін пайдалана отырып әзірлейміз, соның ішінде жалпыға қолжетімді деректер, қол жеткізу үшін үшінші тараптармен серіктес болатын деректер және пайдаланушыларымыз немесе адам жаттықтырушылар мен зерттеушілер ұсынатын немесе жасайтын ақпарат бар. Біз жүйелерімізді синтетикалық деректерді пайдалана отырып та әзірлейміз.
Біз деректерді жүйелерімізге адам тілін және әлемді жақсырақ түсінуге көмектесу үшін пайдаланамыз. Бұл өз кезегінде жүйелерімізге адамның шығармашылығын арттыруға, ғылыми жаңалықтар мен медициналық зерттеулерді ілгерілетуге және жүздеген миллион адамға күнделікті өмірін жақсартуға мүмкіндік береді. Біздің жүйелер мәтіндік, кескіндік, аудио және аудиовизуалды контенттің триллиондаған токенін қамтитын деректер жиындарында әзірленеді.
Біз жүйелерімізді әзірлеу үшін деректердің алуан түрін пайдаланамыз, соның ішінде авторлық құқықпен қорғалуы мүмкін деректер және қоғамдық игіліктегі деректер бар. Оқыту деректер жиындарымыздағы жеке ақпарат көлемін азайту үшін шаралар қабылдағанымызбен, кейбір деректерімізде Калифорния Азаматтық кодексінің 1798.140-бөлімінде анықталғандай жеке ақпарат және тұтынушылар туралы агрегатталған ақпарат болуы мүмкін. Пайдаланушыларымыз өз контентінің оқыту үшін пайдаланылуынан бас тарта алады, сондай-ақ ChatGPT жауаптарынан белгілі бір жеке ақпаратты жоюды біздің Жекелік порталы арқылы сұрай алады. Біз модельдеріміздің өнімділігі мен дәлдігін жақсарту үшін деректер жиындарымызды өңдеудің әртүрлі әдістерін пайдаланамыз.
Біз жүйелерімізді әзірлеу үшін деректер жинауды шамамен 2018 жылы бастадық және деректер жинауды бүгін де жалғастырып келеміз. Біз деректер жиындарымызды жүйелерді әзірлеу үшін алғаш рет 2021 жылы пайдаландық.
Жүйелеріміздің әзірленуі туралы қосымша ақпаратты біздің жүйе карталарымыздан табуға болады.
Калифорния Азаматтық кодексінің 3111-бөліміне сәйкес оқыту деректерінің қысқаша мазмұны
Жаңартылған: 7 days ago
