OpenAI
Aquesta pàgina s'ha traduït automàticament. Mostra l'article original en anglès.

Com identifiquem contingut problemàtic als nostres serveis per a particulars

Learn how OpenAI uses automated systems and human review to identify harmful or policy-violating content in individual services.

Actualització: yesterday

Creiem en el desenvolupament i el desplegament responsables i iteratius com a mitjà per aconseguir una intel·ligència artificial general segura. Fem una quantitat considerable de proves i mitigació en matèria de seguretat i alineació abans de llançar qualsevol model al públic, i també disposem de sistemes automatitzats i humans per ajudar a detectar contingut problemàtic que apareix als nostres serveis per a particulars, com ara ChatGPT i els GPTs. A continuació, descrivim alguns d’aquests esforços.

ChatGPT i ImageGen

Utilitzem eines automatitzades, com ara una versió interna de la nostra API /moderations, per detectar contingut (indicacions, complecions o fitxers pujats) que pugui ser perjudicial o infringir les nostres Polítiques d'ús. Si detectem contingut problemàtic, normalment t'advertirem que el contingut pot infringir les nostres Polítiques d'ús o impedirem que el model respongui a la indicació. També podem impedir que es comparteixi el xat que conté la indicació o la compleció problemàtica. En un conjunt molt limitat de circumstàncies, també podem bloquejar el teu compte per conductes especialment greus.

També acceptem denúncies de persones sobre contingut problemàtic a ChatGPT. Per revisar aquestes denúncies, combinem sistemes automatitzats amb un equip d'experts qualificats.

  • ChatGPT: si algú comparteix un xat que creus que conté contingut problemàtic, també ens el pots denunciar.

Per obtenir més informació sobre com denunciar contingut directament a ChatGPT, consulta aquest article.

GPTs

També utilitzem eines automatitzades, com ara la nostra /moderation API, per veure si un GPT és potencialment problemàtic. Si detectem contingut problemàtic associat amb el GPT, prendrem mesures, com ara impedir que es distribueixi. El creador pot editar la configuració del GPT o de l’API per eliminar el contingut problemàtic, o pot recórrer la decisió mitjançant un flux dins del producte. En un conjunt molt limitat de circumstàncies, també podem suspendre el compte del creador per conductes greus.

També acceptem denúncies de persones sobre GPTs problemàtics. Si veus un GPT que creus que infringeix les nostres polítiques d’ús o que d’una altra manera reflecteix contingut problemàtic, també pots denunciar-lo. Utilitzem una combinació de sistemes automatitzats i un equip d’experts formats per revisar aquestes denúncies.

T'ha estat útil aquest article?