Մենք հավատում ենք պատասխանատու, աստիճանական մշակմանը և ներդրմանը՝ որպես անվտանգ արհեստական ընդհանուր բանականության հասնելու միջոց։ Նախքան մոդելը հանրությանը ներկայացնելը մենք իրականացնում ենք անվտանգության և համահունչության զգալի ծավալի փորձարկումներ և մեղմման միջոցառումներ, ինչպես նաև ունենք ավտոմատացված և մարդկային համակարգեր, որոնք օգնում են հայտնաբերել խնդրահարույց բովանդակությունը, որը հայտնվում է անհատների համար նախատեսված մեր ծառայություններում, ինչպիսիք են ChatGPT-ը և GPT-ները։ Ստորև ներկայացնում ենք այդ ջանքերից մի քանիսը։
ChatGPT և ImageGen
Մենք օգտագործում ենք ավտոմատացված գործիքներ, օրինակ՝ մեր /moderations API-ի ներքին տարբերակը՝ հայտնաբերելու այն բովանդակությունը (հարցումներ, պատասխաններ, վերբեռնումներ), որը կարող է վնասակար լինել կամ խախտել մեր Օգտագործման կանոնները։ Եթե խնդրահարույց բովանդակություն հայտնաբերենք, սովորաբար կզգուշացնենք, որ ձեր բովանդակությունը կարող է խախտել մեր Օգտագործման կանոնները, կամ կարգելենք մոդելին պատասխանել ձեր հարցմանը։ Մենք կարող ենք նաև արգելել խնդրահարույց հարցում կամ պատասխան պարունակող զրույցի տարածումը։ Խիստ սահմանափակ դեպքերում մենք կարող ենք նաև արգելափակել ձեր հաշիվը ծայրահեղ անընդունելի վարքագծի համար։
Մենք ընդունում ենք նաև ChatGPT-ում խնդրահարույց բովանդակության վերաբերյալ մարդկանց հաղորդումները։ Այս հաղորդումները ստուգելու համար մենք համատեղում ենք ավտոմատացված համակարգերի և վերապատրաստված փորձագետների թիմի աշխատանքը։
ChatGPT․ եթե որևէ մեկը տարածել է զրույց, որը, ձեր կարծիքով, խնդրահարույց բովանդակություն է պարունակում, կարող եք նաև հաղորդել մեզ այդ մասին։
ChatGPT-ում անմիջապես բովանդակության մասին հաղորդելու մանրամասներին ծանոթանալու համար կարդացեք այս հոդվածը։
GPT-ներ
Մենք նաև օգտագործում ենք ավտոմատացված գործիքներ, օրինակ՝ մեր /moderation API-ը, ստուգելու համար՝ արդյոք GPT-ն հնարավոր է խնդրահարույց է։ Եթե հայտնաբերենք GPT-ի հետ կապված խնդրահարույց բովանդակություն, միջոցներ կձեռնարկենք, օրինակ՝ կկանխենք դրա տարածումը։ Ստեղծողը կարող է խմբագրել GPT-ի կամ API-ի կազմաձևումը՝ խնդրահարույց բովանդակությունը հեռացնելու համար, կամ կարող է որոշումը բողոքարկել արտադրանքի ներսում գործող գործընթացի միջոցով։ Խիստ սահմանափակ հանգամանքներում կարող ենք նաև արգելափակել ստեղծողի հաշիվը կոպիտ խախտող վարքագծի համար։
Մենք նաև ընդունում ենք խնդրահարույց GPT-ների վերաբերյալ մարդկանց հաղորդումները։ Եթե տեսնում եք GPT, որը, ձեր կարծիքով, խախտում է մեր օգտագործման քաղաքականությունները կամ այլ կերպ ներկայացնում է խնդրահարույց բովանդակություն, կարող եք նաև հաղորդել այդ մասին մեզ։ Մենք օգտագործում ենք ավտոմատացված համակարգերի և փորձագետների պատրաստված թիմի համադրություն՝ այս հաղորդումները վերանայելու համար։
