OpenAI
Šo lapu tulkoja mašīntulks. Skatīt oriģinālo rakstu angļu valodā.

Kā mēs identificējam problemātisku saturu mūsu pakalpojumos privātpersonām

Uzziniet, kā OpenAI izmanto automatizētas sistēmas un cilvēku veiktu pārskatīšanu, lai atsevišķos pakalpojumos identificētu kaitīgu vai noteikumus pārkāpjošu saturu.

Atjaunināts: 6 days ago

Mēs ticam atbildīgai, iteratīvai izstrādei un ieviešanai kā līdzeklim droša mākslīgā vispārējā intelekta sasniegšanai. Pirms modeli vispār piedāvājam sabiedrībai, mēs veicam ievērojamu drošības un saskaņošanas testēšanu un mazināšanas pasākumus, un mums ir arī automatizētas un cilvēku vadītas sistēmas, kas palīdz atklāt problemātisku saturu, kurš parādās mūsu pakalpojumos privātpersonām, piemēram, ChatGPT un GPT. Tālāk izklāstām dažus no šiem centieniem.

ChatGPT un ImageGen

Mēs izmantojam automatizētus rīkus, piemēram, mūsu /moderations API iekšējo versiju, lai atklātu saturu (uzvednes, atbildes, augšupielādes), kas var būt kaitīgs vai pārkāpt mūsu Lietošanas politikas. Ja konstatēsim problemātisku saturu, parasti brīdināsim, ka jūsu saturs var pārkāpt mūsu Lietošanas politikas, vai neļausim modelim atbildēt uz jūsu uzvedni. Varam arī liegt kopīgot sarunu, kurā ir problemātiskā uzvedne vai atbilde. Ļoti retos gadījumos par īpaši nepieņemamu rīcību varam arī bloķēt jūsu kontu.

Mēs pieņemam arī lietotāju ziņojumus par problemātisku saturu pakalpojumā ChatGPT. Šos ziņojumus pārskata gan automatizētas sistēmas, gan apmācītu ekspertu komanda.

  • ChatGPT: ja kāds kopīgo sarunu, kurā, jūsuprāt, ir problemātisks saturs, varat arī par to mums ziņot.

Plašāku informāciju par to, kā ziņot par saturu tieši pakalpojumā ChatGPT, skatiet šajā rakstā.

GPT

Mēs izmantojam arī automatizētus rīkus, piemēram, mūsu /moderation API, lai noteiktu, vai GPT varētu būt problemātisks. Ja konstatēsim ar GPT saistītu problemātisku saturu, mēs rīkosimies, piemēram, liegsim tā izplatīšanu. Izstrādātājs var rediģēt GPT vai API konfigurāciju, lai noņemtu problemātisko saturu, vai pārsūdzēt lēmumu, izmantojot produktā pieejamo procesu. Ļoti ierobežotos gadījumos mēs varam arī aizliegt izstrādātāja kontu par īpaši rupju rīcību.

Mēs pieņemam arī cilvēku ziņojumus par problemātiskiem GPT. Ja redzat GPT, kas, jūsuprāt, pārkāpj mūsu lietošanas politikas vai citādi atspoguļo problemātisku saturu, jūs varat arī ziņot par to mums. Lai izskatītu šos ziņojumus, mēs izmantojam automatizētu sistēmu un apmācītas ekspertu komandas kombināciju.

Vai šis raksts bija noderīgs?