ჩვენ გვჯერა პასუხისმგებლიანი, ეტაპობრივი შემუშავებისა და დანერგვის, როგორც უსაფრთხო ზოგადი ხელოვნური ინტელექტის მიღწევის საშუალების. სანამ მოდელს საზოგადოებისთვის გავუშვებთ, ვატარებთ უსაფრთხოებისა და თანხვედრის მნიშვნელოვან ტესტირებას და რისკების შემცირებას; ასევე გვაქვს ავტომატიზებული და ადამიანური სისტემები, რომლებიც გვეხმარება პრობლემური კონტენტის აღმოჩენაში, როდესაც ის ჩნდება ინდივიდებისთვის განკუთვნილ ჩვენს სერვისებში, როგორიცაა ChatGPT და GPT-ები. ქვემოთ ამ ძალისხმევის ნაწილს აღვწერთ.
ChatGPT და ImageGen
პოტენციურად საზიანო ან ჩვენი გამოყენების წესების დამრღვევი შიგთავსის (მოთხოვნების, პასუხებისა და ატვირთული მასალების) აღმოსაჩენად ვიყენებთ ავტომატიზებულ ინსტრუმენტებს, მათ შორის ჩვენი /moderations API-ის შიდა ვერსიას. პრობლემური შიგთავსის აღმოჩენისას, როგორც წესი, ან გაგაფრთხილებთ, რომ თქვენი შიგთავსი შესაძლოა ჩვენი გამოყენების წესებს არღვევდეს, ან მოდელს თქვენს მოთხოვნაზე პასუხის გაცემის საშუალებას არ მივცემთ. ასევე შეიძლება პრობლემური მოთხოვნის ან პასუხის შემცველი ჩატის გაზიარება ავკრძალოთ. უკიდურესად მიუღებელი ქცევის შემთხვევაში, ძალიან იშვიათ გარემოებებში, შესაძლოა თქვენი ანგარიშიც დავბლოკოთ.
ChatGPT-ში პრობლემური შიგთავსის შესახებ ადამიანებისგან მიღებულ შეტყობინებებსაც ვიღებთ. ამ შეტყობინებების შესამოწმებლად ვიყენებთ ავტომატიზებული სისტემებისა და მომზადებული ექსპერტების გუნდის ერთობლიობას.
ChatGPT: თუ ვინმე გააზიარებს ჩატს, რომელიც, თქვენი აზრით, პრობლემურ შიგთავსს შეიცავს, შეგიძლიათ ამის შესახებ შეგვატყობინოთ.
დამატებითი ინფორმაციისთვის, თუ როგორ შეგვატყობინოთ შიგთავსის შესახებ პირდაპირ ChatGPT-ში, გაეცანით ამ სტატიას.
GPT-ები
ჩვენ ასევე ვიყენებთ ავტომატიზებულ ინსტრუმენტებს, როგორიცაა ჩვენი /moderation API, რათა დავადგინოთ, არის თუ არა GPT პოტენციურად პრობლემური. თუ GPT-სთან დაკავშირებულ პრობლემურ კონტენტს აღმოვაჩენთ, მივიღებთ ზომებს, მაგალითად, შევზღუდავთ მის გავრცელებას. შემქმნელს შეუძლია შეცვალოს GPT-ის ან API-ის კონფიგურაცია პრობლემური კონტენტის მოსაშორებლად, ან გაასაჩივროს გადაწყვეტილება პროდუქტში არსებული პროცესის მეშვეობით. ძალიან შეზღუდულ შემთხვევებში, უკიდურესად უხეში ქცევის გამო, შესაძლოა შემქმნელის ანგარიშიც დავბლოკოთ.
ჩვენ ასევე ვიღებთ ადამიანების მიერ გამოგზავნილ შეტყობინებებს პრობლემური GPT-ების შესახებ. თუ ხედავთ GPT-ს, რომელიც, თქვენი აზრით, არღვევს ჩვენს გამოყენების პოლიტიკებს ან სხვაგვარად ასახავს პრობლემურ კონტენტს, ასევე შეგიძლიათ შეგვატყობინოთ ამის შესახებ. ამ შეტყობინებების განსახილველად ვიყენებთ ავტომატიზებული სისტემებისა და ექსპერტების გადამზადებული გუნდის კომბინაციას.
