Mēs ticam atbildīgai, iteratīvai izstrādei un ieviešanai kā līdzeklim droša mākslīgā vispārējā intelekta sasniegšanai. Pirms modeli vispār piedāvājam sabiedrībai, mēs veicam ievērojamu drošības un saskaņošanas testēšanu un mazināšanas pasākumus, un mums ir arī automatizētas un cilvēku vadītas sistēmas, kas palīdz atklāt problemātisku saturu, kurš parādās mūsu pakalpojumos privātpersonām, piemēram, ChatGPT un GPT. Tālāk izklāstām dažus no šiem centieniem.
ChatGPT un ImageGen
Mēs izmantojam automatizētus rīkus, piemēram, mūsu /moderations API iekšējo versiju, lai noteiktu saturu (uzvednes, pabeigumus, augšupielādes), kas var būt kaitīgs vai pārkāpt mūsu Lietošanas politikas. Ja konstatējam problemātisku saturu, parasti vai nu brīdināsim jūs, ka jūsu saturs var pārkāpt mūsu lietošanas politikas, vai arī bloķēsim modeļa atbildi uz jūsu uzvedni. Mēs varam arī liegt kopīgot tērzēšanu, kurā ir problemātiska uzvedne vai pabeigums. Ļoti ierobežotos gadījumos mēs varam arī aizliegt jūsu kontu par īpaši rupju rīcību.
Mēs pieņemam arī cilvēku ziņojumus par problemātisku saturu ChatGPT. Lai izskatītu šos ziņojumus, mēs izmantojam automatizētu sistēmu un apmācītas ekspertu komandas kombināciju.
ChatGPT: ja kāds kopīgo tērzēšanu, kurā, jūsuprāt, ir problemātisks saturs, jūs varat arī ziņot par to mums.
Plašāku informāciju par to, kā ziņot par saturu tieši ChatGPT, skatiet šajā rakstā.
GPT
Mēs izmantojam arī automatizētus rīkus, piemēram, mūsu /moderation API, lai noteiktu, vai GPT varētu būt problemātisks. Ja konstatēsim ar GPT saistītu problemātisku saturu, mēs rīkosimies, piemēram, liegsim tā izplatīšanu. Izstrādātājs var rediģēt GPT vai API konfigurāciju, lai noņemtu problemātisko saturu, vai pārsūdzēt lēmumu, izmantojot produktā pieejamo procesu. Ļoti ierobežotos gadījumos mēs varam arī aizliegt izstrādātāja kontu par īpaši rupju rīcību.
Mēs pieņemam arī cilvēku ziņojumus par problemātiskiem GPT. Ja redzat GPT, kas, jūsuprāt, pārkāpj mūsu lietošanas politikas vai citādi atspoguļo problemātisku saturu, jūs varat arī ziņot par to mums. Lai izskatītu šos ziņojumus, mēs izmantojam automatizētu sistēmu un apmācītas ekspertu komandas kombināciju.
