OpenAI
Esta página se tradujo automáticamente. Ver el artículo original en inglés.

Cómo identificamos contenido problemático en nuestros servicios para particulares

Actualización: 7 days ago

Creemos en un desarrollo y una implementación responsables e iterativos como medio para lograr una inteligencia artificial general segura. Realizamos una cantidad considerable de pruebas y mitigación de seguridad y alineación antes de lanzar cualquier modelo al público, y también contamos con sistemas automatizados y humanos para ayudar a detectar contenido problemático que aparece en nuestros servicios para particulares, como ChatGPT y GPTs. A continuación describimos algunas de esas iniciativas.

ChatGPT e ImageGen

Utilizamos herramientas automatizadas, como una versión interna de nuestra API /moderations, para detectar contenido (prompts, respuestas generadas y archivos subidos) que pueda ser perjudicial o infringir nuestras Políticas de uso. Si detectamos contenido problemático, normalmente te advertiremos de que tu contenido puede infringir nuestras Políticas de uso o impediremos que el modelo responda a tu prompt. También podemos impedir que se comparta el chat que contenga el prompt o la respuesta problemática. En un conjunto muy limitado de circunstancias, también podemos inhabilitar tu cuenta por conductas especialmente graves.

También aceptamos denuncias de personas sobre contenido problemático en ChatGPT. Para revisar estas denuncias, combinamos sistemas automatizados con un equipo de especialistas debidamente formados.

  • ChatGPT: si alguien comparte un chat que crees que contiene contenido problemático, también puedes denunciárnoslo.

Para obtener más información sobre cómo denunciar contenido directamente en ChatGPT, consulta este artículo.

GPTs

También usamos herramientas automatizadas, como nuestra /moderation API, para comprobar si un GPT puede ser problemático. Si detectamos contenido problemático asociado al GPT, tomaremos medidas, como impedir que se distribuya. El creador puede editar la configuración del GPT o la API para eliminar el contenido problemático, o puede apelar la decisión mediante un flujo dentro del producto. En un conjunto muy limitado de circunstancias, también podemos suspender la cuenta del creador por comportamientos graves.

También aceptamos denuncias de personas sobre GPTs problemáticos. Si ves un GPT que crees que infringe nuestras políticas de uso o que refleja de algún otro modo contenido problemático, también puedes denunciárnoslo. Usamos una combinación de sistemas automatizados y un equipo formado de expertos para revisar estas denuncias.

¿Te ha resultado útil este artículo?