OpenAI
Ova stranica je mašinski prevedena. Pogledaj originalni članak na engleskom jeziku.

Kako prepoznajemo problematičan sadržaj na našim uslugama za pojedince

Saznajte kako OpenAI koristi automatizirane sisteme i ljudsku provjeru za prepoznavanje štetnog sadržaja ili sadržaja koji krši pravila u pojedinačnim uslugama.

Ažurirano: 7 days ago

Vjerujemo u odgovoran, iterativan razvoj i primjenu kao način postizanja sigurne opće umjetne inteligencije. Provodi se znatna količina testiranja i ublažavanja vezanih za sigurnost i usklađivanje prije nego što model uopće predstavimo javnosti, a imamo i automatizirane i ljudske sisteme koji pomažu u otkrivanju problematičnog sadržaja koji se pojavljuje na našim uslugama za pojedince, kao što su ChatGPT i GPT-ovi. U nastavku navodimo neke od tih napora.

ChatGPT i ImageGen

Koristimo automatizirane alate, kao što je interna verzija našeg API-ja /moderations, kako bismo otkrili sadržaj (upite, odgovore i prenesene datoteke) koji može biti štetan ili kršiti naša Pravila korištenja. Ako otkrijemo problematičan sadržaj, obično ćemo vas upozoriti da vaš sadržaj možda krši naša pravila korištenja ili spriječiti model da odgovori na vaš upit. Također možemo onemogućiti dijeljenje razgovora koji sadrži problematičan upit ili odgovor. U vrlo rijetkim okolnostima možemo i blokirati vaš račun zbog naročito neprihvatljivog ponašanja.

Prihvatamo i prijave korisnika o problematičnom sadržaju na ChatGPT-u. Za pregled tih prijava koristimo kombinaciju automatiziranih sistema i obučenog tima stručnjaka.

  • ChatGPT: Ako neko podijeli razgovor za koji smatrate da sadrži problematičan sadržaj, možete nam ga i prijaviti.

Više informacija o tome kako prijaviti sadržaj direktno u ChatGPT-u potražite u ovom članku.

GPT-ovi

Također koristimo automatizirane alate kao što je naš /moderation API kako bismo vidjeli da li je neki GPT potencijalno problematičan. Ako otkrijemo problematičan sadržaj povezan s GPT-om, poduzet ćemo mjere, kao što je sprečavanje njegove distribucije. Kreator može urediti konfiguraciju GPT-a ili API-ja kako bi uklonio problematičan sadržaj ili se može žaliti na odluku kroz tok unutar proizvoda. U vrlo ograničenom broju okolnosti možemo i zabraniti račun kreatora zbog izrazito neprimjerenog ponašanja.

Također prihvatamo prijave ljudi o problematičnim GPT-ovima. Ako vidite GPT za koji smatrate da krši naša pravila korištenja ili na drugi način odražava problematičan sadržaj, možete ga i prijaviti nama. Za pregled tih prijava koristimo kombinaciju automatiziranih sistema i obučenog tima stručnjaka.

Da li je ovaj članak bio koristan?