Kami percaya bahawa pembangunan dan pelancaran secara bertanggungjawab serta berperingkat ialah cara untuk mencapai kecerdasan umum buatan yang selamat. Kami menjalankan banyak ujian dan mitigasi keselamatan serta penjajaran sebelum melancarkan sesebuah model kepada orang awam, dan kami juga menyediakan sistem automatik dan manusia untuk membantu mengesan kandungan bermasalah yang muncul pada perkhidmatan kami untuk individu, seperti ChatGPT dan GPTs. Kami menggariskan beberapa usaha tersebut di bawah.
ChatGPT dan ImageGen
Kami menggunakan alat automatik, seperti versi dalaman /moderations API kami, untuk mengesan kandungan (gesaan, pelengkapan, muat naik) yang mungkin berbahaya atau melanggar Dasar Penggunaan kami. Jika kami mengesan kandungan bermasalah, biasanya kami sama ada akan memberi amaran kepada anda bahawa kandungan anda mungkin melanggar dasar penggunaan kami atau menghalang model daripada membalas gesaan anda. Kami juga mungkin menghalang sembang dengan gesaan atau pelengkapan bermasalah daripada dikongsi. Dalam keadaan yang sangat terhad, kami juga mungkin mengharamkan akaun anda kerana tingkah laku yang keterlaluan.
Kami juga menerima laporan daripada manusia tentang kandungan bermasalah di ChatGPT. Kami menggunakan gabungan sistem automatik dan pasukan pakar terlatih untuk menyemak laporan ini.
ChatGPT: Jika seseorang berkongsi sembang yang anda percaya mengandungi kandungan bermasalah, anda juga boleh melaporkannya kepada kami.
Untuk butiran lanjut tentang cara melaporkan kandungan secara langsung dalam ChatGPT, lihat artikel ini.
GPTs
Kami juga menggunakan alat automatik seperti /moderation API kami untuk melihat sama ada sesuatu GPT berpotensi bermasalah. Jika kami mengesan kandungan bermasalah yang dikaitkan dengan GPT tersebut, kami akan mengambil tindakan, seperti menghalangnya daripada diedarkan. Pembina boleh mengedit konfigurasi GPT atau API untuk mengalih keluar kandungan bermasalah, atau merayu keputusan itu melalui proses dalam produk. Dalam keadaan yang sangat terhad, kami juga mungkin mengharamkan akaun pembina kerana tingkah laku yang keterlaluan.
Kami juga menerima laporan daripada manusia tentang GPT yang bermasalah. Jika anda melihat GPT yang anda percaya melanggar dasar penggunaan kami atau mengandungi kandungan bermasalah dalam bentuk lain, anda juga boleh melaporkannya kepada kami. Kami menggunakan gabungan sistem automatik dan pasukan pakar terlatih untuk menyemak laporan ini.
