Vjerujemo u odgovoran, iterativan razvoj i primjenu kao način postizanja sigurne opće umjetne inteligencije. Provodi se znatna količina testiranja i ublažavanja vezanih za sigurnost i usklađivanje prije nego što model uopće predstavimo javnosti, a imamo i automatizirane i ljudske sisteme koji pomažu u otkrivanju problematičnog sadržaja koji se pojavljuje na našim uslugama za pojedince, kao što su ChatGPT i GPT-ovi. U nastavku navodimo neke od tih napora.
ChatGPT i ImageGen
Koristimo automatizirane alate, kao što je interna verzija našeg /moderations API-ja, za otkrivanje sadržaja (upita, dovršetaka, otpremanja) koji može biti štetan ili kršiti naša Pravila korištenja. Ako otkrijemo problematičan sadržaj, obično ćemo vas ili upozoriti da vaš sadržaj može kršiti naša pravila korištenja ili blokirati model da odgovori na vaš upit. Također možemo spriječiti dijeljenje razgovora s problematičnim upitom ili dovršetkom. U vrlo ograničenom broju okolnosti možemo i zabraniti vaš račun zbog izrazito neprimjerenog ponašanja.
Također prihvatamo prijave ljudi o problematičnom sadržaju na ChatGPT-u. Za pregled tih prijava koristimo kombinaciju automatiziranih sistema i obučenog tima stručnjaka.
ChatGPT: Ako neko podijeli razgovor za koji smatrate da sadrži problematičan sadržaj, možete ga i prijaviti nama.
Za više detalja o tome kako prijaviti sadržaj direktno u ChatGPT-u, pogledajte ovaj članak.
GPT-ovi
Također koristimo automatizirane alate kao što je naš /moderation API kako bismo vidjeli da li je neki GPT potencijalno problematičan. Ako otkrijemo problematičan sadržaj povezan s GPT-om, poduzet ćemo mjere, kao što je sprečavanje njegove distribucije. Kreator može urediti konfiguraciju GPT-a ili API-ja kako bi uklonio problematičan sadržaj ili se može žaliti na odluku kroz tok unutar proizvoda. U vrlo ograničenom broju okolnosti možemo i zabraniti račun kreatora zbog izrazito neprimjerenog ponašanja.
Također prihvatamo prijave ljudi o problematičnim GPT-ovima. Ako vidite GPT za koji smatrate da krši naša pravila korištenja ili na drugi način odražava problematičan sadržaj, možete ga i prijaviti nama. Za pregled tih prijava koristimo kombinaciju automatiziranih sistema i obučenog tima stručnjaka.
