Біз қауіпсіз жалпы жасанды интеллектке қол жеткізудің жолы ретінде жауапты, итерациялық әзірлеу мен енгізуге сенеміз. Көпшілікке модель ұсынбас бұрын, қауіпсіздік пен сәйкестендіру бойынша елеулі сынақтар және тәуекелді азайту шараларын жүргіземіз, сондай-ақ ChatGPT және GPT-тер сияқты жеке пайдаланушыларға арналған қызметтерімізде пайда болатын проблемалық контентті анықтауға көмектесу үшін автоматтандырылған және адам қатысатын жүйелеріміз бар. Төменде сол күш-жігердің кейбірін сипаттаймыз.
ChatGPT және ImageGen
Біз ықтимал зиянды болуы немесе Пайдалану саясаттарымызды бұзуы мүмкін контентті (көмексөздер, жауаптар, жүктеп салулар) анықтау үшін /moderations API ішкі нұсқасы сияқты автоматтандырылған құралдарды қолданамыз. Егер проблемалық контент анықтасақ, әдетте контентіңіз пайдалану саясаттарымызды бұзуы мүмкін екенін ескертеміз немесе модельдің көмексөзіңізге жауап беруін бұғаттаймыз. Сондай-ақ проблемалық көмексөз немесе жауап қамтылған чатты бөлісуге тыйым салуымыз мүмкін. Өте шектеулі жағдайларда өрескел мінез-құлық үшін аккаунтыңызға тыйым салуымыз да мүмкін.
ChatGPT-тегі проблемалық контент туралы адамдардан хабарламаларды да қабылдаймыз. Бұл хабарламаларды тексеру үшін автоматтандырылған жүйелер мен оқытылған сарапшылар тобын бірге қолданамыз.
ChatGPT: Егер біреу сіз проблемалық контент бар деп санайтын чатты бөліссе, оны бізге хабарлай аласыз.
ChatGPT ішінде контентті тікелей қалай хабарлау туралы толығырақ ақпаратты осы мақаладан қараңыз.
GPT-тер
Сондай-ақ GPT ықтимал проблемалық екенін анықтау үшін /moderation API сияқты автоматтандырылған құралдарды қолданамыз. Егер GPT-пен байланысты проблемалық контент анықтасақ, оның таратылуына жол бермеу сияқты шаралар қолданамыз. Жасаушы GPT немесе API конфигурациясын өңдеп, проблемалық контентті жоя алады немесе өнім ішіндегі процесс арқылы шешімге шағымдана алады. Өте шектеулі жағдайларда өрескел мінез-құлық үшін жасаушының аккаунтына тыйым салуымыз да мүмкін.
Проблемалық GPT-тер туралы адамдардан хабарламаларды да қабылдаймыз. Егер пайдалану саясаттарымызды бұзады деп санайтын немесе басқаша проблемалық контентті қамтитын GPT-ті көрсеңіз, оны бізге хабарлай аласыз. Бұл хабарламаларды тексеру үшін автоматтандырылған жүйелер мен оқытылған сарапшылар тобын бірге қолданамыз.
