Біз қауіпсіз жалпы жасанды интеллектке қол жеткізудің жолы ретінде жауапты, итерациялық әзірлеу мен енгізуге сенеміз. Көпшілікке модель ұсынбас бұрын, қауіпсіздік пен сәйкестендіру бойынша елеулі сынақтар және тәуекелді азайту шараларын жүргіземіз, сондай-ақ ChatGPT және GPT-тер сияқты жеке пайдаланушыларға арналған қызметтерімізде пайда болатын проблемалық контентті анықтауға көмектесу үшін автоматтандырылған және адам қатысатын жүйелеріміз бар. Төменде сол күш-жігердің кейбірін сипаттаймыз.
ChatGPT және ImageGen
Зиян келтіруі немесе Пайдалану саясаттарымызды бұзуы мүмкін контентті (көмексөздерді, жауаптарды, жүктеп салынған файлдарды) анықтау үшін /moderations API интерфейсінің ішкі нұсқасы сияқты автоматтандырылған құралдарды пайдаланамыз. Проблемалы контент анықталса, әдетте контентіңіз Пайдалану саясаттарымызды бұзуы мүмкін екенін ескертеміз немесе модельдің көмексөзіңізге жауап беруіне жол бермейміз. Сондай-ақ проблемалы көмексөз немесе жауап бар чатты бөлісуге тыйым салуымыз мүмкін. Өте сирек жағдайларда өрескел әрекет үшін есептік жазбаңызға тыйым салуымыз да мүмкін.
Сондай-ақ ChatGPT-тегі проблемалы контент туралы адамдардың шағымдарын қабылдаймыз. Бұл шағымдарды автоматтандырылған жүйелер мен арнайы даярланған сарапшылар тобының көмегімен тексереміз.
ChatGPT: Егер біреу проблемалы контент бар деп есептейтін чатты бөліссе, ол туралы бізге хабарлай аласыз.
Контент туралы тікелей ChatGPT ішінде хабарлау жолы жөнінде толығырақ ақпаратты осы мақаладан қараңыз.
GPT-тер
Сондай-ақ GPT ықтимал проблемалық екенін анықтау үшін /moderation API сияқты автоматтандырылған құралдарды қолданамыз. Егер GPT-пен байланысты проблемалық контент анықтасақ, оның таратылуына жол бермеу сияқты шаралар қолданамыз. Жасаушы GPT немесе API конфигурациясын өңдеп, проблемалық контентті жоя алады немесе өнім ішіндегі процесс арқылы шешімге шағымдана алады. Өте шектеулі жағдайларда өрескел мінез-құлық үшін жасаушының аккаунтына тыйым салуымыз да мүмкін.
Проблемалық GPT-тер туралы адамдардан хабарламаларды да қабылдаймыз. Егер пайдалану саясаттарымызды бұзады деп санайтын немесе басқаша проблемалық контентті қамтитын GPT-ті көрсеңіз, оны бізге хабарлай аласыз. Бұл хабарламаларды тексеру үшін автоматтандырылған жүйелер мен оқытылған сарапшылар тобын бірге қолданамыз.
