Awaké dhéwé percaya marang pangembangan lan penerapan sing tanggung jawab lan iteratif minangka sarana kanggo nggayuh kecerdhasan umum tiruan sing aman. Awaké dhéwé nindakake akèh pangujian lan mitigasi keamanan lan panyelarasan sadurungé ngluncuraké model marang publik, lan awaké dhéwé uga nduwé sistem otomatis lan manungsa kanggo mbantu ndeteksi konten bermasalah sing muncul ing layanan kanggo individu kayata ChatGPT lan GPTs. Awaké dhéwé njlentrehaké sawetara upaya kasebut ing ngisor iki.
ChatGPT lan ImageGen
Kita nggunakake piranti otomatis, kayata versi internal saka API /moderations kita, kanggo ndeteksi konten (prompt, wangsulan, unggahan) sing bisa mbebayani utawa nglanggar Kawicaksanan Panggunaan kita. Yen ndeteksi konten sing ana masalah, lumrahe kita bakal ngelingake manawa konten sampeyan bisa nglanggar kawicaksanan panggunaan kita utawa ngalangi model supaya ora nanggapi prompt sampeyan. Kita uga bisa nyegah obrolan sing ngemot prompt utawa wangsulan sing ana masalah supaya ora dituduhake. Ing kahanan tartamtu sing arang banget, kita uga bisa mblokir akun sampeyan amarga tumindak sing kebangeten.
Kita uga nampa laporan saka wong ngenani konten sing ana masalah ing ChatGPT. Kita nggunakake gabungan sistem otomatis lan tim ahli sing wis dilatih kanggo mriksa laporan kasebut.
ChatGPT: Yen ana wong nuduhake obrolan sing miturut sampeyan ngemot konten sing ana masalah, sampeyan uga bisa nglaporake marang kita.
Kanggo katrangan luwih lengkap babagan cara nglaporake konten langsung ing ChatGPT, wacanen artikel iki.
GPTs
Awaké dhéwé uga nggunakake piranti otomatis kayata /moderation API kanggo mriksa apa sawijining GPT duwé potensi bermasalah. Yen awaké dhéwé ndeteksi konten bermasalah sing gegandhengan karo GPT, awaké dhéwé bakal njupuk tindakan, kayata nyegah supaya ora disebaraké. Panggawe bisa nyunting konfigurasi GPT utawa API kanggo mbusak konten bermasalah, utawa bisa ngajokaké bandhing marang keputusan liwat alur ing produk. Ing kahanan sing winates banget, awaké dhéwé uga bisa mblokir akun panggawe amarga tumindak sing parah banget.
Awaké dhéwé uga nampa laporan saka wong bab GPT sing bermasalah. Yen sampeyan weruh GPT sing miturut sampeyan nglanggar kabijakan panggunaan kita utawa nuduhaké konten bermasalah, sampeyan uga bisa nglaporaké marang kita. Awaké dhéwé nggunakake gabungan sistem otomatis lan tim ahli sing wis dilatih kanggo mriksa laporan kasebut.
