OpenAI
Ang page na ito ay isinalin ng AI. Tingnan ang orihinal na artikulo sa English.

Paano namin tinutukoy ang problematikong nilalaman sa aming mga serbisyo para sa mga indibidwal

Na-update: 3 days ago

Naniniwala kami sa responsable at pauli-ulit na development at deployment bilang paraan para makamit ang ligtas na artificial general intelligence. Nagsasagawa kami ng malaking dami ng testing at mitigation para sa kaligtasan at alignment bago kailanman maglunsad ng modelo sa publiko, at mayroon din kaming mga automated at pantao na system para tumulong na matukoy ang problemadong content na lumalabas sa aming mga serbisyo para sa mga indibidwal gaya ng ChatGPT at GPTs. Inilalarawan namin sa ibaba ang ilan sa mga pagsisikap na iyon.

ChatGPT at ImageGen

Gumagamit kami ng mga awtomatikong tool, gaya ng panloob na bersyon ng aming /moderations API, para matukoy ang content (mga prompt, tugon, at upload) na maaaring makasama o lumabag sa aming Mga Patakaran sa Paggamit. Kung may matukoy kaming problematikong content, karaniwan ay babalaan ka naming maaaring lumabag ang content mo sa aming mga patakaran sa paggamit o hahadlangan naming tumugon ang modelo sa prompt mo. Maaari rin naming pigilang maibahagi ang chat na naglalaman ng problematikong prompt o tugon. Sa iilang natatanging sitwasyon, maaari rin naming i-ban ang account mo dahil sa matinding paglabag.

Tumatanggap din kami ng mga ulat mula sa mga tao tungkol sa problematikong content sa ChatGPT. Gumagamit kami ng kumbinasyon ng mga awtomatikong system at sinanay na pangkat ng mga eksperto para suriin ang mga ulat na ito.

  • ChatGPT: Kung may nagbahagi ng chat na sa tingin mo ay may problematikong content, maaari mo rin itong iulat sa amin.

Para sa higit pang detalye kung paano direktang mag-ulat ng content sa ChatGPT, tingnan ang artikulong ito.

Mga GPT

Gumagamit din kami ng mga automated na tool gaya ng aming /moderation API para makita kung posibleng problemado ang isang GPT. Kung may matukoy kaming problemadong content na nauugnay sa GPT, kikilos kami, gaya ng pagpigil na maipamahagi ito. Maaaring i-edit ng builder ang configuration ng GPT o API para alisin ang problemadong content, o maaari niyang iapela ang desisyon sa pamamagitan ng flow sa produkto. Sa napakalimitadong mga sitwasyon, maaari rin naming i-ban ang account ng builder dahil sa malubhang asal.

Tumatanggap din kami ng mga ulat mula sa tao tungkol sa mga problemadong GPT. Kung makakita ka ng GPT na sa tingin mo ay lumalabag sa aming mga patakaran sa paggamit o nagpapakita ng problemadong content, maaari mo rin itong iulat sa amin. Gumagamit kami ng kombinasyon ng mga automated na system at sinanay na team ng mga eksperto para suriin ang mga ulat na ito.

Nakatulong ba ang artikulong ito?