OpenAI používa signály pôvodu, ako sú vodoznaky SynthID a Content Credentials (C2PA), aby ľudia mohli zistiť, či bol obsah vytvorený pomocou nástrojov OpenAI. Signály pôvodu môžu byť užitočnými ukazovateľmi zdroja, nezaručujú však, že obsah je presný, neupravený, v zákonnom vlastníctve alebo uvedený v správnom kontexte.
Čo je štandard C2PA a čo umožňuje?
C2PA je otvorený technický štandard, ktorý vydavateľom, spoločnostiam a ďalším subjektom umožňuje vkladať do médií metadáta na overenie ich pôvodu a súvisiacich informácií. C2PA nie je určený len pre obsah vytvorený umelou inteligenciou. Rovnaký štandard zavádzajú aj výrobcovia fotoaparátov, spravodajské organizácie a ďalšie subjekty, aby mohli osvedčiť zdroj a históriu, teda pôvod mediálneho obsahu.
Metadáta C2PA môžu obsahovať informácie o nástroji alebo službe, ktoré súbor vytvorili, čase jeho vytvorenia a ďalšie podrobnosti o jeho pôvode či histórii.
Ďalšie informácie o C2PA.
Čo je SynthID a čo umožňuje?
SynthID je technológia neviditeľných vodoznakov, ktorá vkladá signál priamo do vytvoreného mediálneho obsahu. Na rozdiel od metadát je signál súčasťou samotného obsahu a môže pretrvať aj po niektorých úpravách alebo transformáciách.
SynthID poskytuje popri metadátach C2PA ďalší signál pôvodu. Ak sa napríklad z súboru odstránia metadáta, vložený vodoznak môže naďalej signalizovať, že obsah bol vytvorený pomocou podporovaných nástrojov OpenAI.
Ktoré typy obsahu vytvoreného pomocou OpenAI obsahujú signály pôvodu?
OpenAI používa pre rôzne typy obsahu rôzne signály pôvodu.
| Typ obsahu | Signály pôvodu | Poznámky |
|---|---|---|
| Obrázky | Metadáta C2PA a vodoznaky SynthID | Podporované obrázky vytvorené pomocou ChatGPT, Codex a rozhrania OpenAI API obsahujú oba signály. |
| Zvuk | Vodoznaky SynthID | Podporovaný zvuk vytvorený pomocou OpenAI obsahuje nepočuteľný vodoznak vložený priamo do zvukovej stopy. |
Pokrytie sa môže líšiť podľa produktu, modelu, spôsobu exportu, typu súboru a času vytvorenia obsahu.
Prečo sa pri niektorých typoch obsahu používajú odlišné signály pôvodu?
Rôzne formáty médií uchovávajú informácie o pôvode rôznymi spôsobmi.
Metadáta, ako sú C2PA Content Credentials, môžu obsahovať podrobnejšie informácie, platformy, nástroje na úpravu alebo konverzie súborov ich však niekedy môžu odstrániť.
Vodoznaky, ako je SynthID, sú vložené priamo do vytvoreného mediálneho obsahu a môžu lepšie odolávať niektorým transformáciám. Vodoznaky však vo všeobecnosti poskytujú menej kontextu než metadáta.
Ak je to technicky možné, vhodné spojenie oboch prístupov pomáha poskytovať spoľahlivejšie signály pôvodu.
Ako môžem pridať viditeľný vodoznak do obrázka vytvoreného pomocou nástrojov OpenAI?
Pri obrázkoch vytvorených pomocou ChatGPT, Codex a rozhrania OpenAI API môžete model prostredníctvom pokynu požiadať, aby pridal viditeľné označenie. Pri vytváraní obrázka môžete napríklad zadať: „Include a visible OpenAI watermark in the image.“
Viditeľné vodoznaky sú oddelené od vložených signálov pôvodu, ako sú metadáta C2PA a vodoznaky SynthID. Môžu divákom pomôcť rozpoznať, že obrázok bol vytvorený pomocou nástrojov OpenAI, nie sú však totožné so strojovo čitateľnými signálmi pôvodu.
Ako môžem overiť, či bol obsah vytvorený pomocou nástrojov OpenAI?
Na stránke openai.com/verify môžete skontrolovať, či podporovaný obrázok alebo zvukový súbor obsahuje signály pôvodu spojené s obsahom vytvoreným alebo exportovaným pomocou nástrojov OpenAI.
Po nahraní podporovaného súboru nástroj vyhľadá podporované signály pôvodu OpenAI, napríklad vodoznak SynthID alebo dôveryhodný manifest C2PA spojený s OpenAI.
Ak nástroj nájde podporovaný signál pôvodu OpenAI, znamená to, že obsah bol vytvorený alebo exportovaný pomocou nástrojov OpenAI.
Čo znamená výsledok overenia?
Ak sa zistí signál, nástroj môže pomôcť potvrdiť, že nahraný obsah obsahuje podporovaný signál pôvodu spojený s OpenAI.
Nástroj nepotvrdzuje, že obsah je presný, neupravený, v zákonnom vlastníctve alebo uvedený v správnom kontexte. Takisto neurčuje, kto obsah vytvoril ani prečo vznikol.
Čo ak sa nenájde žiadny signál?
Ak sa nezistí žiadny signál, znamená to, že nástroj v nahranom súbore nenašiel signály pôvodu vydané spoločnosťou OpenAI.
Obsah mohol byť napriek tomu vytvorený alebo exportovaný pomocou OpenAI, ak:
Obsah bol vytvorený skôr, než boli signály pôvodu k dispozícii.
Obsah pochádza z nepodporovaného produktu, modelu, spôsobu exportu alebo typu súboru.
Metadáta sa odstránili pri nahrávaní, sťahovaní, úprave, konverzii alebo zdieľaní.
Vodoznak bol narušený kompresiou, orezaním, šumom, úpravami, konverziou formátu alebo inými transformáciami.
Zvukový klip je príliš krátky alebo bol výrazne upravený.
Plánujete podporovať textové výstupy?
V súlade s našimi záväzkami vyplývajúcimi z Kódexu postupov Európskej komisie pre transparentnosť obsahu vytvoreného umelou inteligenciou chceme rozšíriť signály pôvodu na všetky modality vrátane textu. Zákazníci a vývojári tak budú mať jasné možnosti, ako plniť svoje povinnosti v oblasti transparentnosti, kým sa budú ďalej vyvíjať štandardy a nástroje.
Dokáže OpenAI Verify rozpoznať obsah z iných nástrojov AI?
OpenAI Verify je určený na rozpoznávanie podporovaných signálov pôvodu spojených s obsahom vytvoreným alebo exportovaným pomocou nástrojov OpenAI.
Nie je určený na rozpoznávanie obsahu vytvoreného inými službami AI. Nemusí rozpoznať ani obsah vytvorený pomocou OpenAI, ak príslušný signál chýba, nie je podporovaný alebo bol narušený.
Môžu vývojári overovať obsah pomocou rozhrania API?
Vývojári a organizácie môžu pomocou overovacieho rozhrania API od OpenAI kontrolovať podporovaný obsah a vyhľadávať v ňom signály pôvodu OpenAI. Overovanie môžu tiež integrovať do vlastných aplikácií alebo pracovných postupov. Informácie o prístupe k rozhraniu API nájdete na stránke openai.com/verify. Organizácie, ktoré potrebujú vyššie limity používania, môžu požiadať o ich zvýšenie. Ďalšie informácie nájdete na stránke openai.com/verify.
