OpenAI

व्यक्तियों के लिए हमारी सेवाओं पर समस्याग्रस्त कंटेंट की पहचान हम कैसे करते हैं

Learn how OpenAI uses automated systems and human review to identify harmful or policy-violating content in individual services.

अपडेट किया गया: 22 hours ago

हम सुरक्षित आर्टिफ़िशियल जेनरल इंटेलिजेंस हासिल करने के साधन के रूप में ज़िम्मेदार, पुनरावृत्तिमूलक विकास और तैनाती में विश्वास करते हैं. हम किसी मॉडल को सार्वजनिक रूप से लॉन्च करने से पहले सुरक्षा और संरेखण से जुड़े काफी व्यापक परीक्षण और रोकथाम करते हैं, और ChatGPT और GPTs जैसी हमारी सेवाओं पर दिखाई देने वाली समस्याग्रस्त सामग्री का पता लगाने में मदद के लिए हमारे पास स्वचालित और मानव प्रणालियाँ भी मौजूद हैं. हम नीचे उन प्रयासों में से कुछ की रूपरेखा प्रस्तुत करते हैं.

ChatGPT और ImageGen

हम ऐसे कंटेंट (प्रॉम्प्ट, कम्प्लीशन, अपलोड) का पता लगाने के लिए स्वचालित उपकरणों का उपयोग करते हैं, जैसे हमारी /moderations API का आंतरिक संस्करण, जो हानिकारक हो सकता है या हमारी उपयोग नीतियों का उल्लंघन कर सकता है. अगर हमें समस्याजनक कंटेंट का पता चलता है, तो आम तौर पर हम या तो आपको चेतावनी देंगे कि आपका कंटेंट हमारी उपयोग नीतियों का उल्लंघन कर सकता है, या मॉडल को आपके प्रॉम्प्ट का जवाब देने से रोक देंगे. हम समस्यात्मक प्रॉम्प्ट या पूर्णता वाली चैट को साझा किए जाने से भी रोक सकते हैं. बहुत सीमित परिस्थितियों में, अत्यंत गंभीर अनुचित व्यवहार के लिए हम आपके खाते पर प्रतिबंध भी लगा सकते हैं.

हम ChatGPT पर समस्याजनक कंटेंट के बारे में मानव रिपोर्ट भी स्वीकार करते हैं. हम इन रिपोर्टों की समीक्षा करने के लिए स्वचालित प्रणालियों और विशेषज्ञों की एक प्रशिक्षित टीम के संयोजन का उपयोग करते हैं.

ChatGPT में सीधे कंटेंट की रिपोर्ट करने के तरीके के बारे में अधिक जानकारी के लिए, यह लेख देखें.

GPTs

हम यह देखने के लिए कि कोई GPT संभावित रूप से समस्याग्रस्त है या नहीं, अपने /moderation API जैसे स्वचालित टूल का भी उपयोग करते हैं. अगर हमें GPT से जुड़ी समस्याजनक कंटेंट का पता चलता है, तो हम कार्रवाई करेंगे, जैसे उस GPT को वितरित किए जाने से रोकना. बिल्डर समस्याजनक कंटेंट हटाने के लिए GPT या API के कॉन्फ़िगरेशन को संपादित कर सकता है या इन-प्रोडक्ट फ़्लो के माध्यम से निर्णय के विरुद्ध अपील कर सकता है. बहुत सीमित परिस्थितियों में, हम अत्यंत गंभीर आपत्तिजनक व्यवहार के लिए बिल्डर के खाते पर भी प्रतिबंध लगा सकते हैं.

हम समस्याग्रस्त GPTs के बारे में लोगों द्वारा की गई रिपोर्टें भी स्वीकार करते हैं. अगर आपको कोई ऐसा GPT दिखाई देता है जो हमारी उपयोग नीतियों का उल्लंघन करता है या किसी अन्य तरह से समस्याजनक सामग्री दर्शाता है, तो आप हमें इसकी रिपोर्ट भी कर सकते हैं. हम इन रिपोर्टों की समीक्षा करने के लिए स्वचालित प्रणालियों और विशेषज्ञों की एक प्रशिक्षित टीम का उपयोग करते हैं.

क्या यह लेख मददगार था?