OpenAI
Αυτή η σελίδα μεταφράστηκε αυτόματα. Δείτε το πρωτότυπο άρθρο στα αγγλικά.

Πώς εντοπίζουμε προβληματικό περιεχόμενο στις υπηρεσίες μας για ιδιώτες

Learn how OpenAI uses automated systems and human review to identify harmful or policy-violating content in individual services.

Τελευταία ενημέρωση: 6 minutes ago

Πιστεύουμε στην υπεύθυνη, επαναληπτική ανάπτυξη και διάθεση ως μέσο για την επίτευξη ασφαλούς τεχνητής γενικής νοημοσύνης. Πραγματοποιούμε σημαντικό όγκο δοκιμών και μετριασμού ως προς την ασφάλεια και την ευθυγράμμιση πριν διαθέσουμε οποιοδήποτε μοντέλο στο κοινό, ενώ διαθέτουμε επίσης αυτοματοποιημένα και ανθρώπινα συστήματα για να βοηθούν στον εντοπισμό προβληματικού περιεχομένου που εμφανίζεται στις υπηρεσίες μας για ιδιώτες, όπως το ChatGPT και τα GPTs. Παραθέτουμε ορισμένες από αυτές τις προσπάθειες παρακάτω.

ChatGPT και ImageGen

Χρησιμοποιούμε αυτοματοποιημένα εργαλεία, όπως μια εσωτερική έκδοση του API /moderations, για να εντοπίζουμε περιεχόμενο (προτροπές, αποκρίσεις, μεταφορτώσεις) που ενδέχεται να είναι επιβλαβές ή να παραβιάζει τις Πολιτικές Χρήσης μας. Αν εντοπίσουμε προβληματικό περιεχόμενο, συνήθως είτε θα σας προειδοποιήσουμε ότι το περιεχόμενό σας ενδέχεται να παραβιάζει τις Πολιτικές Χρήσης μας είτε θα εμποδίσουμε το μοντέλο να απαντήσει στην προτροπή σας. Ενδέχεται επίσης να εμποδίσουμε την κοινοποίηση της συνομιλίας που περιέχει την προβληματική προτροπή ή απόκριση. Σε πολύ περιορισμένες περιπτώσεις, ενδέχεται επίσης να αποκλείσουμε τον λογαριασμό σας λόγω κατάφωρα παραβατικής συμπεριφοράς.

Δεχόμαστε επίσης αναφορές από χρήστες σχετικά με προβληματικό περιεχόμενο στο ChatGPT. Για την εξέταση αυτών των αναφορών, χρησιμοποιούμε έναν συνδυασμό αυτοματοποιημένων συστημάτων και μιας εκπαιδευμένης ομάδας ειδικών.

  • ChatGPT: Αν κάποιος κοινοποιήσει μια συνομιλία που πιστεύετε ότι περιέχει προβληματικό περιεχόμενο, μπορείτε επίσης να μας την αναφέρετε.

Για περισσότερες λεπτομέρειες σχετικά με το πώς μπορείτε να αναφέρετε περιεχόμενο απευθείας στο ChatGPT, ανατρέξτε σε αυτό το άρθρο.

GPTs

Χρησιμοποιούμε επίσης αυτοματοποιημένα εργαλεία, όπως το /moderation API μας, για να διαπιστώνουμε αν ένα GPT είναι δυνητικά προβληματικό. Αν εντοπίσουμε προβληματικό περιεχόμενο που σχετίζεται με το GPT, θα λάβουμε μέτρα, όπως το να αποτρέψουμε τη διανομή του. Ο δημιουργός μπορεί να επεξεργαστεί τη διαμόρφωση του GPT ή του API για να αφαιρέσει το προβληματικό περιεχόμενο ή μπορεί να ασκήσει ένσταση κατά της απόφασης μέσω μιας ροής εντός προϊόντος. Σε πολύ περιορισμένες περιπτώσεις, ενδέχεται επίσης να αποκλείσουμε τον λογαριασμό του δημιουργού για κατάφωρη συμπεριφορά.

Δεχόμαστε επίσης αναφορές από ανθρώπους για προβληματικά GPTs. Αν δείτε ένα GPT που πιστεύετε ότι παραβιάζει τις πολιτικές χρήσης μας ή αντικατοπτρίζει με άλλον τρόπο προβληματικό περιεχόμενο, μπορείτε επίσης να μας το αναφέρετε. Χρησιμοποιούμε έναν συνδυασμό αυτοματοποιημένων συστημάτων και μιας εκπαιδευμένης ομάδας ειδικών για να εξετάζουμε αυτές τις αναφορές.

Σας βοήθησε αυτό το άρθρο;