ჩვენ გვჯერა პასუხისმგებლიანი, ეტაპობრივი შემუშავებისა და დანერგვის, როგორც უსაფრთხო ზოგადი ხელოვნური ინტელექტის მიღწევის საშუალების. სანამ მოდელს საზოგადოებისთვის გავუშვებთ, ვატარებთ უსაფრთხოებისა და თანხვედრის მნიშვნელოვან ტესტირებას და რისკების შემცირებას; ასევე გვაქვს ავტომატიზებული და ადამიანური სისტემები, რომლებიც გვეხმარება პრობლემური კონტენტის აღმოჩენაში, როდესაც ის ჩნდება ინდივიდებისთვის განკუთვნილ ჩვენს სერვისებში, როგორიცაა ChatGPT და GPT-ები. ქვემოთ ამ ძალისხმევის ნაწილს აღვწერთ.
ChatGPT და ImageGen
ჩვენ ვიყენებთ ავტომატიზებულ ინსტრუმენტებს, როგორიცაა ჩვენი /moderations API-ის შიდა ვერსია, ისეთი კონტენტის (მოთხოვნები, დასრულებები, ატვირთვები) აღმოსაჩენად, რომელიც შეიძლება საზიანო იყოს ან არღვევდეს ჩვენს გამოყენების პოლიტიკებს. თუ პრობლემურ კონტენტს აღმოვაჩენთ, როგორც წესი, ან გაგაფრთხილებთ, რომ თქვენი კონტენტი შეიძლება არღვევდეს ჩვენს გამოყენების პოლიტიკებს, ან მოდელს დავბლოკავთ, რომ თქვენს მოთხოვნას არ უპასუხოს. ასევე შეიძლება ავკრძალოთ იმ ჩატის გაზიარება, რომელიც პრობლემურ მოთხოვნას ან დასრულებას შეიცავს. ძალიან შეზღუდულ შემთხვევებში, უკიდურესად უხეში ქცევის გამო, შესაძლოა თქვენი ანგარიშიც დავბლოკოთ.
ჩვენ ასევე ვიღებთ ადამიანების მიერ გამოგზავნილ შეტყობინებებს ChatGPT-ზე პრობლემური კონტენტის შესახებ. ამ შეტყობინებების განსახილველად ვიყენებთ ავტომატიზებული სისტემებისა და ექსპერტების გადამზადებული გუნდის კომბინაციას.
ChatGPT: თუ ვინმე გააზიარებს ჩატს, რომელიც, თქვენი აზრით, პრობლემურ კონტენტს შეიცავს, ასევე შეგიძლიათ შეგვატყობინოთ ამის შესახებ.
დამატებითი დეტალებისთვის, თუ როგორ შეატყობინოთ კონტენტის შესახებ პირდაპირ ChatGPT-ში, იხილეთ ეს სტატია.
GPT-ები
ჩვენ ასევე ვიყენებთ ავტომატიზებულ ინსტრუმენტებს, როგორიცაა ჩვენი /moderation API, რათა დავადგინოთ, არის თუ არა GPT პოტენციურად პრობლემური. თუ GPT-სთან დაკავშირებულ პრობლემურ კონტენტს აღმოვაჩენთ, მივიღებთ ზომებს, მაგალითად, შევზღუდავთ მის გავრცელებას. შემქმნელს შეუძლია შეცვალოს GPT-ის ან API-ის კონფიგურაცია პრობლემური კონტენტის მოსაშორებლად, ან გაასაჩივროს გადაწყვეტილება პროდუქტში არსებული პროცესის მეშვეობით. ძალიან შეზღუდულ შემთხვევებში, უკიდურესად უხეში ქცევის გამო, შესაძლოა შემქმნელის ანგარიშიც დავბლოკოთ.
ჩვენ ასევე ვიღებთ ადამიანების მიერ გამოგზავნილ შეტყობინებებს პრობლემური GPT-ების შესახებ. თუ ხედავთ GPT-ს, რომელიც, თქვენი აზრით, არღვევს ჩვენს გამოყენების პოლიტიკებს ან სხვაგვარად ასახავს პრობლემურ კონტენტს, ასევე შეგიძლიათ შეგვატყობინოთ ამის შესახებ. ამ შეტყობინებების განსახილველად ვიყენებთ ავტომატიზებული სისტემებისა და ექსპერტების გადამზადებული გუნდის კომბინაციას.
