Acreditamos no desenvolvimento e na implementação responsáveis e iterativos como forma de alcançar uma inteligência artificial geral segura. Realizamos uma quantidade considerável de testes e mitigação de segurança e alinhamento antes de lançar qualquer modelo ao público, e também temos sistemas automatizados e humanos para ajudar a detetar conteúdo problemático que aparece nos nossos serviços para utilizadores individuais, como o ChatGPT e os GPTs. Descrevemos alguns desses esforços abaixo.
ChatGPT e ImageGen
Utilizamos ferramentas automatizadas, como uma versão interna da nossa API /moderations, para detetar conteúdos (prompts, respostas geradas e carregamentos) que possam ser prejudiciais ou violar as nossas Políticas de Utilização. Se detetarmos conteúdo problemático, normalmente avisamos que o seu conteúdo pode violar as nossas políticas de utilização ou impedimos o modelo de responder ao seu prompt. Também podemos impedir a partilha da conversa que contenha o prompt ou a resposta problemática. Num conjunto muito limitado de circunstâncias, também podemos banir a sua conta por comportamentos particularmente graves.
Também aceitamos denúncias feitas por pessoas sobre conteúdo problemático no ChatGPT. Utilizamos uma combinação de sistemas automatizados e uma equipa de especialistas com formação para analisar estas denúncias.
ChatGPT: se alguém partilhar uma conversa que considere conter conteúdo problemático, também pode denunciá-la.
Para obter mais informações sobre como denunciar conteúdo diretamente no ChatGPT, consulte este artigo.
GPTs
Também utilizamos ferramentas automatizadas, como a nossa API /moderation, para verificar se um GPT é potencialmente problemático. Se detetarmos conteúdo problemático associado ao GPT, tomaremos medidas, como impedir a sua distribuição. O criador pode editar a configuração do GPT ou da API para remover o conteúdo problemático, ou pode recorrer da decisão através de um fluxo no produto. Num conjunto muito limitado de circunstâncias, também podemos banir a conta do criador por comportamento grave.
Também aceitamos denúncias feitas por pessoas sobre GPTs problemáticos. Se vir um GPT que considera violar as nossas políticas de utilização ou refletir, de outro modo, conteúdo problemático, também pode denunciá-lo junto de nós. Utilizamos uma combinação de sistemas automatizados e uma equipa de especialistas com formação para analisar estas denúncias.
