OpenAI använder provenienssignaler som SynthID-vattenstämplar och Content Credentials (C2PA) för att hjälpa människor att förstå om innehåll har skapats med OpenAI-verktyg. Provenienssignaler kan ge värdefull information om ursprunget, men de garanterar inte att innehållet är korrekt, oredigerat, lagligen ägt eller presenterat i rätt sammanhang.
Vad är C2PA-standarden och vad möjliggör den?
C2PA är en öppen teknisk standard som gör det möjligt för utgivare, företag och andra att bädda in metadata i medier för att verifiera deras ursprung och relaterad information. C2PA är inte bara avsett för AI-genererat innehåll. Samma standard införs även av kameratillverkare, nyhetsorganisationer och andra för att intyga medieinnehållets källa och historik, det vill säga proveniens.
C2PA-metadata kan innehålla information om exempelvis vilket verktyg eller vilken tjänst som skapade en fil, när den skapades och andra uppgifter om dess ursprung eller historik.
Läs mer om C2PA.
Vad är SynthID och vad möjliggör det?
SynthID är en teknik för osynlig vattenmärkning som bäddar in en signal direkt i genererade medier. Till skillnad från metadata är signalen en del av själva innehållet och kan finnas kvar efter vissa redigeringar eller omvandlingar.
SynthID ger en ytterligare provenienssignal vid sidan av C2PA-metadata. Om metadata exempelvis tas bort från en fil kan en inbäddad vattenstämpel fortfarande signalera att innehållet skapades med OpenAI-verktyg som stöds.
Vilka typer av innehåll som skapats med OpenAI innehåller provenienssignaler?
OpenAI använder olika provenienssignaler för olika typer av innehåll.
| Innehållstyp | Provenienssignaler | Anmärkningar |
|---|---|---|
| Bilder | C2PA-metadata och SynthID-vattenstämplar | Bilder som stöds och skapas med ChatGPT, Codex och OpenAI:s API innehåller båda signalerna. |
| Ljud | SynthID-vattenstämplar | Ljud som stöds och skapats med OpenAI innehåller en ohörbar vattenstämpel som är inbäddad i själva ljudet. |
Täckningen kan variera beroende på produkt, Modell, exportväg, filtyp och när innehållet skapades.
Varför använder vissa innehållstyper olika provenienssignaler?
Olika medieformat bevarar proveniensinformation på olika sätt.
Metadata, som C2PA Content Credentials, kan innehålla mer detaljerad information, men kan ibland tas bort av plattformar, redigeringsverktyg eller filkonverteringar.
Vattenstämplar som SynthID bäddas in i de genererade medierna och kan vara mer beständiga vid vissa omvandlingar. Vattenstämplar ger dock i allmänhet mindre sammanhang än metadata.
När det är tekniskt möjligt bidrar en lämplig kombination av båda metoderna till starkare provenienssignaler.
Hur lägger jag till en synlig vattenstämpel i en bild som skapats med OpenAI-verktyg?
Du kan be Modellen att lägga till en synlig märkning på bilder som skapas med ChatGPT, Codex och OpenAI:s API. När du skapar en bild kan du exempelvis skriva: “Include a visible OpenAI watermark in the image.”
Synliga vattenstämplar är separata från inbäddade provenienssignaler som C2PA-metadata och SynthID-vattenstämplar. De kan hjälpa betraktare att se att en bild skapats med OpenAI-verktyg, men de är inte samma sak som maskinläsbara provenienssignaler.
Hur kan jag kontrollera om innehåll har skapats med OpenAI-verktyg?
Besök openai.com/verify för att kontrollera om en bild eller ljudfil som stöds innehåller provenienssignaler kopplade till innehåll som skapats eller exporterats med OpenAI-verktyg.
När du har laddat upp en fil som stöds söker verktyget efter provenienssignaler från OpenAI som stöds, till exempel en SynthID-vattenstämpel eller ett betrott C2PA-Manifest kopplat till OpenAI.
Om verktyget hittar en provenienssignal från OpenAI som stöds tyder det på att innehållet har skapats av eller exporterats från OpenAI-verktyg.
Vad betyder ett verifieringsresultat?
Om en signal upptäcks kan verktyget hjälpa till att bekräfta att det uppladdade innehållet har en provenienssignal som stöds och är kopplad till OpenAI.
Verktyget bekräftar inte att innehållet är korrekt, oredigerat, lagligen ägt eller presenterat i rätt sammanhang. Det identifierar inte heller vem som skapade innehållet eller varför det skapades.
Vad händer om ingen signal hittas?
Om ingen signal upptäcks innebär det att verktyget inte hittade några provenienssignaler utfärdade av OpenAI i den uppladdade filen.
Innehållet kan ändå ha skapats eller exporterats av OpenAI om:
Innehållet skapades innan provenienssignaler fanns tillgängliga.
Innehållet kom från en produkt, Modell, exportväg eller filtyp som inte stöds.
Metadata togs bort vid uppladdning, nedladdning, redigering, konvertering eller delning.
En vattenstämpel försämrades av komprimering, beskärning, brus, redigering, formatkonvertering eller andra omvandlingar.
Ett ljudklipp är för kort eller har ändrats avsevärt.
Planerar ni att stödja textutdata?
I linje med våra åtaganden enligt EU-kommissionens uppförandekod för transparens kring AI-genererat innehåll är vårt mål att utöka provenienssignalerna till alla modaliteter, inklusive text. På så sätt får kunder och utvecklare tydliga sätt att uppfylla sina egna transparenskrav i takt med att standarder och verktyg fortsätter att utvecklas.
Kan OpenAI Verify upptäcka innehåll från andra AI-verktyg?
OpenAI Verify är utformat för att upptäcka provenienssignaler som stöds och som är kopplade till innehåll som skapats eller exporterats med OpenAI-verktyg.
Det är inte utformat för att upptäcka innehåll som skapats av andra AI-tjänster. Det kan även missa innehåll som skapats av OpenAI om den relevanta signalen saknas, inte stöds eller har försämrats.
Kan utvecklare verifiera innehåll via ett API?
Utvecklare och organisationer kan använda OpenAI:s verifierings-API för att kontrollera om innehåll som stöds har provenienssignaler från OpenAI och integrera verifiering i sina egna appar eller arbetsflöden. Besök openai.com/verify för information om API-åtkomst. Organisationer som behöver högre användningsgränser kan ansöka om höjda gränser. Besök openai.com/verify för mer information.
