जबाबदार, पुनरावृत्त विकास आणि तैनाती हा सुरक्षित आर्टिफिशियल जनरल इंटेलिजन्स साध्य करण्याचा मार्ग आहे, असा आमचा विश्वास आहे. एखादे मॉडेल सार्वजनिकपणे लाँच करण्यापूर्वी आम्ही सुरक्षा आणि अलाइनमेंटसाठी मोठ्या प्रमाणात चाचण्या आणि शमन करतो, आणि ChatGPT व GPTs सारख्या व्यक्तींसाठीच्या आमच्या सेवांवर दिसणारी समस्यात्मक सामग्री शोधण्यात मदत करण्यासाठी आमच्याकडे स्वयंचलित आणि मानवी प्रणालीही आहेत. त्या प्रयत्नांपैकी काहींची रूपरेषा आम्ही खाली देत आहोत.
ChatGPT आणि ImageGen
हानीकारक असू शकणारी किंवा आमच्या वापर धोरणांचे उल्लंघन करणारी सामग्री (प्रॉम्प्ट, तयार केलेले प्रतिसाद, अपलोड) शोधण्यासाठी आम्ही आमच्या /moderations एपीआयच्या अंतर्गत आवृत्तीसारखी स्वयंचलित साधने वापरतो. आम्हाला समस्याप्रधान सामग्री आढळल्यास, तुमची सामग्री आमच्या वापर धोरणांचे उल्लंघन करू शकते असा इशारा आम्ही सहसा देऊ किंवा तुमच्या प्रॉम्प्टला प्रतिसाद देण्यापासून मॉडेलला रोखू. समस्याप्रधान प्रॉम्प्ट किंवा प्रतिसाद असलेले संभाषण शेअर करण्यापासूनही आम्ही तुम्हाला रोखू शकतो. अत्यंत मर्यादित परिस्थितींमध्ये, अतिशय गंभीर गैरवर्तन केल्याबद्दल आम्ही तुमच्या खात्यावर बंदीही घालू शकतो.
ChatGPT वरील समस्याप्रधान सामग्रीबद्दल वापरकर्त्यांनी केलेले अहवालही आम्ही स्वीकारतो. या अहवालांचे परीक्षण करण्यासाठी आम्ही स्वयंचलित प्रणाली आणि प्रशिक्षित तज्ज्ञांचा चमू यांचा एकत्रितपणे वापर करतो.
ChatGPT: एखाद्याने शेअर केलेल्या संभाषणात समस्याप्रधान सामग्री आहे असे तुम्हाला वाटत असल्यास, तुम्ही आमच्याकडे त्याचा अहवाल देऊ शकता.
ChatGPT मध्ये थेट सामग्रीचा अहवाल कसा द्यायचा याबद्दल अधिक माहितीसाठी हा लेख पाहा.
GPTs
GPT संभाव्यतः समस्यात्मक आहे का हे पाहण्यासाठी आम्ही आमच्या /moderation API सारखी स्वयंचलित साधनेही वापरतो. GPT शी संबंधित समस्यात्मक सामग्री आढळल्यास, त्याचे वितरण रोखणे यासारखी कारवाई आम्ही करू. समस्यात्मक सामग्री काढण्यासाठी निर्माता GPT किंवा API चे कॉन्फिगरेशन संपादित करू शकतो किंवा उत्पादनातील प्रक्रियेद्वारे निर्णयाविरुद्ध अपील करू शकतो. अत्यंत मर्यादित परिस्थितींमध्ये, गंभीर गैरवर्तनासाठी आम्ही निर्मात्याच्या खात्यावरही बंदी घालू शकतो.
आम्ही समस्यात्मक GPTs बद्दल मानवी अहवालही स्वीकारतो. जर तुम्हाला असा GPT दिसला जो आमच्या वापर धोरणांचे उल्लंघन करत आहे किंवा अन्यथा समस्यात्मक सामग्री दर्शवतो असे वाटत असेल, तर तुम्ही त्याचा आमच्याकडे अहवाल देऊ शकता. या अहवालांचे पुनरावलोकन करण्यासाठी आम्ही स्वयंचलित प्रणाली आणि प्रशिक्षित तज्ज्ञांच्या टीमचा संयुक्त वापर करतो.
