Մենք հավատում ենք պատասխանատու, աստիճանական մշակմանը և ներդրմանը՝ որպես անվտանգ արհեստական ընդհանուր բանականության հասնելու միջոց։ Նախքան մոդելը հանրությանը ներկայացնելը մենք իրականացնում ենք անվտանգության և համահունչության զգալի ծավալի փորձարկումներ և մեղմման միջոցառումներ, ինչպես նաև ունենք ավտոմատացված և մարդկային համակարգեր, որոնք օգնում են հայտնաբերել խնդրահարույց բովանդակությունը, որը հայտնվում է անհատների համար նախատեսված մեր ծառայություններում, ինչպիսիք են ChatGPT-ը և GPT-ները։ Ստորև ներկայացնում ենք այդ ջանքերից մի քանիսը։
ChatGPT և ImageGen
Մենք օգտագործում ենք ավտոմատացված գործիքներ, օրինակ՝ մեր /moderations API-ի ներքին տարբերակը, հայտնաբերելու համար բովանդակություն (հարցումներ, լրացումներ, վերբեռնումներ), որը կարող է վնասակար լինել կամ խախտել մեր օգտագործման քաղաքականությունները։ Եթե հայտնաբերենք խնդրահարույց բովանդակություն, սովորաբար կամ կզգուշացնենք ձեզ, որ ձեր բովանդակությունը կարող է խախտել մեր օգտագործման քաղաքականությունները, կամ կարգելափակենք մոդելի պատասխանը ձեր հարցմանը։ Մենք կարող ենք նաև թույլ չտալ, որ խնդրահարույց հարցում կամ լրացում պարունակող չատը տարածվի։ Խիստ սահմանափակ հանգամանքներում կարող ենք նաև արգելափակել ձեր հաշիվը կոպիտ խախտող վարքագծի համար։
Մենք նաև ընդունում ենք ChatGPT-ում խնդրահարույց բովանդակության վերաբերյալ մարդկանց հաղորդումները։ Մենք օգտագործում ենք ավտոմատացված համակարգերի և փորձագետների պատրաստված թիմի համադրություն՝ այս հաղորդումները վերանայելու համար։
ChatGPT. Եթե որևէ մեկը կիսվում է չատով, որը, ձեր կարծիքով, պարունակում է խնդրահարույց բովանդակություն, կարող եք նաև հաղորդել այդ մասին մեզ։
Լրացուցիչ մանրամասների համար, թե ինչպես անմիջապես ChatGPT-ում հաղորդել բովանդակության մասին, տեսեք այս հոդվածը։
GPT-ներ
Մենք նաև օգտագործում ենք ավտոմատացված գործիքներ, օրինակ՝ մեր /moderation API-ը, ստուգելու համար՝ արդյոք GPT-ն հնարավոր է խնդրահարույց է։ Եթե հայտնաբերենք GPT-ի հետ կապված խնդրահարույց բովանդակություն, միջոցներ կձեռնարկենք, օրինակ՝ կկանխենք դրա տարածումը։ Ստեղծողը կարող է խմբագրել GPT-ի կամ API-ի կազմաձևումը՝ խնդրահարույց բովանդակությունը հեռացնելու համար, կամ կարող է որոշումը բողոքարկել արտադրանքի ներսում գործող գործընթացի միջոցով։ Խիստ սահմանափակ հանգամանքներում կարող ենք նաև արգելափակել ստեղծողի հաշիվը կոպիտ խախտող վարքագծի համար։
Մենք նաև ընդունում ենք խնդրահարույց GPT-ների վերաբերյալ մարդկանց հաղորդումները։ Եթե տեսնում եք GPT, որը, ձեր կարծիքով, խախտում է մեր օգտագործման քաղաքականությունները կամ այլ կերպ ներկայացնում է խնդրահարույց բովանդակություն, կարող եք նաև հաղորդել այդ մասին մեզ։ Մենք օգտագործում ենք ավտոմատացված համակարգերի և փորձագետների պատրաստված թիմի համադրություն՝ այս հաղորդումները վերանայելու համար։
