OpenAI používa signály pôvodu, ako sú vodoznaky SynthID a údaje Content Credentials (C2PA), ktoré ľuďom pomáhajú zistiť, či bol obsah vygenerovaný nástrojmi OpenAI. Signály pôvodu môžu byť užitočnými ukazovateľmi zdroja, nezaručujú však, že obsah je presný, neupravený, v zákonnom vlastníctve ani že je prezentovaný v správnom kontexte.
Čo je štandard C2PA a čo umožňuje?
C2PA je otvorený technický štandard, ktorý vydavateľom, spoločnostiam a ďalším subjektom umožňuje vkladať do médií metadáta na overenie ich pôvodu a súvisiacich informácií. C2PA nie je určený len pre obsah generovaný umelou inteligenciou. Rovnaký štandard zavádzajú aj výrobcovia fotoaparátov, spravodajské organizácie a ďalšie subjekty, aby potvrdili zdroj a históriu, teda pôvod, mediálneho obsahu.
Metadáta C2PA môžu obsahovať informácie, ako sú nástroj alebo služba použitá na vytvorenie súboru, čas jeho vytvorenia a ďalšie podrobnosti o jeho pôvode či histórii.
Ďalšie informácie o C2PA.
Čo je SynthID a čo umožňuje?
SynthID je technológia neviditeľných vodoznakov, ktorá vkladá signál priamo do generovaných médií. Na rozdiel od metadát je signál súčasťou samotného obsahu a môže sa zachovať aj po niektorých úpravách či transformáciách.
SynthID poskytuje popri metadátach C2PA ďalší signál pôvodu. Ak sa napríklad zo súboru odstránia metadáta, vložený vodoznak môže naďalej signalizovať, že obsah bol vygenerovaný podporovanými nástrojmi OpenAI.
Ktoré typy obsahu generovaného nástrojmi OpenAI obsahujú signály pôvodu?
OpenAI používa pre rôzne typy obsahu rôzne signály pôvodu.
| Typ obsahu | Signály pôvodu | Poznámky |
|---|---|---|
| Obrázky | Metadáta C2PA a vodoznaky SynthID | Podporované obrázky vygenerované pomocou ChatGPT, Codex a rozhrania OpenAI API obsahujú oba signály. |
| Zvuk | Vodoznaky SynthID | Podporovaný zvuk vygenerovaný nástrojmi OpenAI obsahuje nepočuteľný vodoznak vložený priamo do zvukovej stopy. |
Dostupnosť sa môže líšiť podľa produktu, modelu, spôsobu exportu, typu súboru a času vytvorenia obsahu.
Prečo používajú niektoré typy obsahu odlišné signály pôvodu?
Rôzne formáty médií uchovávajú informácie o pôvode rôznymi spôsobmi.
Metadáta, ako sú údaje C2PA Content Credentials, môžu obsahovať podrobnejšie informácie, platformy, nástroje na úpravu alebo konverzie súborov ich však niekedy môžu odstrániť.
Vodoznaky, ako je SynthID, sú vložené priamo do vygenerovaných médií a môžu lepšie odolávať niektorým transformáciám. Vodoznaky však vo všeobecnosti poskytujú menej kontextu než metadáta.
Ak je to technicky možné a vhodné, kombinácia oboch prístupov pomáha poskytovať spoľahlivejšie signály pôvodu.
Ako môžem pridať viditeľný vodoznak do obrázka vygenerovaného nástrojmi OpenAI?
Pri obrázkoch generovaných pomocou ChatGPT, Codex a rozhrania OpenAI API môžete model požiadať, aby pridal viditeľné označenie. Pri generovaní obrázka môžete napríklad zadať: „Include a visible OpenAI watermark in the image.“
Viditeľné vodoznaky sú oddelené od vložených signálov pôvodu, ako sú metadáta C2PA a vodoznaky SynthID. Môžu divákom pomôcť rozpoznať, že obrázok bol vygenerovaný nástrojmi OpenAI, nie sú však totožné so strojovo čitateľnými signálmi pôvodu.
Ako môžem overiť, či bol obsah vygenerovaný nástrojmi OpenAI?
Na stránke openai.com/verify môžete skontrolovať, či podporovaný obrázok alebo zvukový súbor obsahuje signály pôvodu spojené s obsahom vygenerovaným alebo exportovaným nástrojmi OpenAI.
Po nahratí podporovaného súboru nástroj vyhľadá podporované signály pôvodu OpenAI, napríklad vodoznak SynthID alebo dôveryhodný manifest C2PA spojený s OpenAI.
Ak nástroj nájde podporovaný signál pôvodu OpenAI, znamená to, že obsah bol vygenerovaný nástrojmi OpenAI alebo z nich exportovaný.
Čo znamená výsledok overenia?
Ak sa zistí signál, nástroj môže pomôcť potvrdiť, že nahraný obsah zahŕňa podporovaný signál pôvodu spojený s OpenAI.
Nástroj nepotvrdzuje, že obsah je presný, neupravený, v zákonnom vlastníctve ani že je prezentovaný v správnom kontexte. Neurčuje ani to, kto obsah vytvoril alebo prečo vznikol.
Čo ak sa nenájde žiadny signál?
Ak sa nezistí žiadny signál, znamená to, že nástroj v nahranom súbore nenašiel signály pôvodu vydané spoločnosťou OpenAI.
Obsah mohol byť napriek tomu vygenerovaný alebo exportovaný nástrojmi OpenAI, ak:
Obsah vznikol skôr, než boli signály pôvodu k dispozícii.
Obsah pochádza z nepodporovaného produktu, modelu, spôsobu exportu alebo typu súboru.
Metadáta sa odstránili počas nahrávania, sťahovania, úprav, konverzie alebo zdieľania.
Vodoznak sa znehodnotil kompresiou, orezaním, šumom, úpravami, konverziou formátu alebo inými transformáciami.
Zvukový klip je príliš krátky alebo bol výrazne upravený.
Plánujete podporovať aj textové výstupy?
V súlade s našimi záväzkami podľa Kódexu postupov Európskej komisie týkajúceho sa transparentnosti obsahu generovaného umelou inteligenciou chceme rozšíriť signály pôvodu na všetky modality vrátane textu. Zákazníci a vývojári tak budú mať jasné možnosti, ako plniť svoje povinnosti v oblasti transparentnosti, kým sa štandardy a nástroje budú ďalej zdokonaľovať.
Dokáže OpenAI Verify rozpoznať obsah z iných nástrojov umelej inteligencie?
OpenAI Verify je určený na zisťovanie podporovaných signálov pôvodu spojených s obsahom vygenerovaným alebo exportovaným nástrojmi OpenAI.
Nie je určený na rozpoznávanie obsahu vygenerovaného inými službami umelej inteligencie. Nemusí rozpoznať ani obsah generovaný nástrojmi OpenAI, ak príslušný signál chýba, nie je podporovaný alebo je znehodnotený.
Môžu vývojári overovať obsah prostredníctvom rozhrania API?
Vývojári a organizácie môžu pomocou overovacieho rozhrania OpenAI API kontrolovať podporovaný obsah na prítomnosť signálov pôvodu OpenAI a začleniť overovanie do vlastných aplikácií alebo pracovných postupov. Informácie o prístupe k rozhraniu API nájdete na stránke openai.com/verify. Organizácie, ktoré potrebujú vyššie limity používania, môžu požiadať o ich zvýšenie. Ďalšie informácie nájdete na stránke openai.com/verify.
