Creiem en el desenvolupament i el desplegament responsables i iteratius com a mitjà per aconseguir una intel·ligència artificial general segura. Fem una quantitat considerable de proves i mitigació en matèria de seguretat i alineació abans de llançar qualsevol model al públic, i també disposem de sistemes automatitzats i humans per ajudar a detectar contingut problemàtic que apareix als nostres serveis per a particulars, com ara ChatGPT i els GPTs. A continuació, descrivim alguns d’aquests esforços.
ChatGPT i ImageGen
Utilitzem eines automatitzades, com ara una versió interna de la nostra /moderations API, per detectar contingut (indicacions, respostes, pujades) que pugui ser perjudicial o infringir les nostres polítiques d’ús. Si detectem contingut problemàtic, normalment t’avisarem que el teu contingut pot infringir les nostres polítiques d’ús o impedirem que el model respongui a la teva indicació. També podem impedir que es comparteixi el xat amb la indicació o la resposta problemàtica. En un conjunt molt limitat de circumstàncies, també podem suspendre el teu compte per conductes greus.
També acceptem denúncies de persones sobre contingut problemàtic a ChatGPT. Utilitzem una combinació de sistemes automatitzats i un equip d’experts formats per revisar aquestes denúncies.
ChatGPT: Si algú comparteix un xat que creus que conté contingut problemàtic, també pots denunciar-lo.
Per obtenir més detalls sobre com denunciar contingut directament a ChatGPT, consulta aquest article.
GPTs
També utilitzem eines automatitzades, com ara la nostra /moderation API, per veure si un GPT és potencialment problemàtic. Si detectem contingut problemàtic associat amb el GPT, prendrem mesures, com ara impedir que es distribueixi. El creador pot editar la configuració del GPT o de l’API per eliminar el contingut problemàtic, o pot recórrer la decisió mitjançant un flux dins del producte. En un conjunt molt limitat de circumstàncies, també podem suspendre el compte del creador per conductes greus.
També acceptem denúncies de persones sobre GPTs problemàtics. Si veus un GPT que creus que infringeix les nostres polítiques d’ús o que d’una altra manera reflecteix contingut problemàtic, també pots denunciar-lo. Utilitzem una combinació de sistemes automatitzats i un equip d’experts formats per revisar aquestes denúncies.
