A OpenAI utiliza sinais de proveniência, como marcas de água SynthID e Credenciais de Conteúdo (C2PA), para ajudar as pessoas a perceber se um conteúdo foi gerado com ferramentas da OpenAI. Os sinais de proveniência podem ser indicadores úteis da origem, mas não garantem que o conteúdo seja exato, não tenha sido editado, seja legalmente detido ou esteja apresentado no contexto correto.
O que é a norma C2PA e o que permite fazer?
A C2PA é uma norma técnica aberta que permite a editores, empresas e outras entidades incorporar metadados em conteúdos multimédia para verificar a respetiva origem e informações relacionadas. A C2PA não se destina apenas a conteúdos gerados por IA. A mesma norma está também a ser adotada por fabricantes de câmaras, organizações noticiosas e outras entidades para certificarem a fonte e o histórico, ou proveniência, dos conteúdos multimédia.
Os metadados C2PA podem incluir informações como a ferramenta ou o serviço que criou um ficheiro, a data da sua criação e outros dados sobre a respetiva origem ou histórico.
Saiba mais sobre a C2PA.
O que é o SynthID e o que permite fazer?
O SynthID é uma tecnologia de marca de água invisível que incorpora um sinal diretamente nos conteúdos multimédia gerados. Ao contrário dos metadados, o sinal faz parte do próprio conteúdo e pode persistir após algumas edições ou transformações.
O SynthID fornece um sinal de proveniência adicional, a par dos metadados C2PA. Por exemplo, se os metadados forem removidos de um ficheiro, uma marca de água incorporada ainda poderá indicar que o conteúdo foi gerado com ferramentas compatíveis da OpenAI.
Que tipos de conteúdo gerado pela OpenAI incluem sinais de proveniência?
A OpenAI utiliza diferentes sinais de proveniência para diferentes tipos de conteúdo.
| Tipo de conteúdo | Sinais de proveniência | Notas |
|---|---|---|
| Imagens | Metadados C2PA e marcas de água SynthID | As imagens compatíveis geradas com o ChatGPT, o Codex e a API da OpenAI incluem ambos os sinais. |
| Áudio | Marcas de água SynthID | Os conteúdos de áudio compatíveis gerados pela OpenAI incluem uma marca de água inaudível incorporada no próprio áudio. |
A cobertura pode variar consoante o produto, o modelo, o método de exportação, o tipo de ficheiro e a data de criação do conteúdo.
Porque utilizam alguns tipos de conteúdo diferentes sinais de proveniência?
Os diferentes formatos multimédia preservam as informações de proveniência de formas distintas.
Os metadados, como as Credenciais de Conteúdo C2PA, podem conter informações mais detalhadas, mas por vezes podem ser removidos por plataformas, ferramentas de edição ou conversões de ficheiros.
As marcas de água, como o SynthID, são incorporadas nos próprios conteúdos multimédia gerados e podem ser mais resistentes a algumas transformações. No entanto, as marcas de água geralmente fornecem menos contexto do que os metadados.
Quando for tecnicamente viável, utilizar ambas as abordagens nos casos adequados ajuda a fornecer sinais de proveniência mais robustos.
Como posso adicionar uma marca de água visível a uma imagem gerada com ferramentas da OpenAI?
Pode pedir uma indicação visível nas imagens geradas com o ChatGPT, o Codex e a API da OpenAI, solicitando ao modelo que a inclua. Por exemplo, ao gerar uma imagem, pode dizer: «Include a visible OpenAI watermark in the image.»
As marcas de água visíveis são distintas dos sinais de proveniência incorporados, como os metadados C2PA e as marcas de água SynthID. Podem ajudar os utilizadores a reconhecer que uma imagem foi gerada com ferramentas da OpenAI, mas não são o mesmo que sinais de proveniência legíveis por máquina.
Como posso verificar se um conteúdo foi gerado com ferramentas da OpenAI?
Pode visitar openai.com/verify para verificar se uma imagem ou um ficheiro de áudio compatível contém sinais de proveniência associados a conteúdo gerado ou exportado por ferramentas da OpenAI.
Depois de carregar um ficheiro compatível, a ferramenta procurará sinais de proveniência da OpenAI suportados, como uma marca de água SynthID ou um manifesto C2PA fidedigno associado à OpenAI.
Se a ferramenta encontrar um sinal de proveniência da OpenAI suportado, isso indica que o conteúdo foi gerado por ferramentas da OpenAI ou exportado a partir delas.
O que significa um resultado de verificação?
Se for detetado um sinal, a ferramenta pode ajudar a confirmar que o conteúdo carregado contém um sinal de proveniência suportado associado à OpenAI.
A ferramenta não confirma que o conteúdo seja exato, não tenha sido editado, seja legalmente detido ou esteja apresentado no contexto correto. Também não identifica quem criou o conteúdo nem por que motivo foi criado.
O que acontece se não for encontrado nenhum sinal?
Se não for detetado nenhum sinal, significa que a ferramenta não encontrou no ficheiro carregado sinais de proveniência emitidos pela OpenAI.
Ainda assim, o conteúdo poderá ter sido gerado ou exportado pela OpenAI se:
O conteúdo tiver sido criado antes de os sinais de proveniência estarem disponíveis.
O conteúdo for proveniente de um produto, modelo, método de exportação ou tipo de ficheiro não suportado.
Os metadados tiverem sido removidos durante o carregamento, a transferência, a edição, a conversão ou a partilha.
Uma marca de água tiver sido degradada por compressão, recorte, ruído, edições, conversão de formato ou outras transformações.
Um excerto de áudio for demasiado curto ou tiver sido significativamente alterado.
Há planos para suportar resultados em texto?
Em conformidade com os nossos compromissos ao abrigo do Código de Conduta da Comissão Europeia sobre a transparência dos conteúdos gerados por IA, o nosso objetivo é alargar os sinais de proveniência a todas as modalidades, incluindo o texto, para que clientes e programadores disponham de formas claras de cumprir as suas próprias obrigações de transparência à medida que as normas e as ferramentas continuam a evoluir.
O OpenAI Verify consegue detetar conteúdos de outras ferramentas de IA?
O OpenAI Verify foi concebido para detetar sinais de proveniência suportados associados a conteúdos gerados ou exportados por ferramentas da OpenAI.
Não foi concebido para detetar conteúdos gerados por outros serviços de IA e poderá também não detetar conteúdos gerados pela OpenAI se o sinal relevante estiver ausente, não for suportado ou estiver degradado.
Os programadores podem verificar conteúdos através de uma API?
Os programadores e as organizações podem utilizar a API de verificação da OpenAI para procurar sinais de proveniência da OpenAI em conteúdos compatíveis e integrar a verificação nas suas próprias aplicações ou fluxos de trabalho. Visite openai.com/verify para obter informações sobre o acesso à API. As organizações que necessitem de limites de utilização mais elevados podem solicitar o respetivo aumento. Para obter mais informações, visite openai.com/verify.
