OpenAI používá signály původu, jako jsou vodoznaky SynthID a Content Credentials (C2PA), aby lidé mohli lépe zjistit, zda byl obsah vytvořen pomocí nástrojů OpenAI. Signály původu mohou být užitečnými ukazateli zdroje, ale nezaručují, že je obsah přesný, neupravený, v zákonném vlastnictví nebo prezentovaný ve správném kontextu.
Co je standard C2PA a co umožňuje?
C2PA je otevřený technický standard, který vydavatelům, firmám a dalším subjektům umožňuje vkládat do médií metadata pro ověření jejich původu a souvisejících informací. C2PA není určen pouze pro obsah vytvořený pomocí AI. Tentýž standard zavádějí také výrobci fotoaparátů, zpravodajské organizace a další subjekty, aby mohli ověřovat zdroj a historii neboli původ mediálního obsahu.
Metadata C2PA mohou obsahovat například informace o nástroji nebo službě, které soubor vytvořily, o době jeho vytvoření a další údaje o jeho původu či historii.
Další informace o C2PA.
Co je SynthID a co umožňuje?
SynthID je technologie neviditelných vodoznaků, která vkládá signál přímo do vytvořených médií. Na rozdíl od metadat je signál součástí samotného obsahu a může přetrvat i po některých úpravách nebo transformacích.
SynthID poskytuje vedle metadat C2PA další signál původu. Pokud jsou například z souboru odstraněna metadata, vložený vodoznak může nadále signalizovat, že byl obsah vytvořen pomocí podporovaných nástrojů OpenAI.
Které typy obsahu vytvořeného pomocí OpenAI obsahují signály původu?
OpenAI používá pro různé typy obsahu různé signály původu.
| Typ obsahu | Signály původu | Poznámky |
|---|---|---|
| Obrázky | Metadata C2PA a vodoznaky SynthID | Podporované obrázky vytvořené pomocí ChatGPT, Codexu a rozhraní OpenAI API obsahují oba signály. |
| Zvuk | Vodoznaky SynthID | Podporovaný zvuk vytvořený pomocí OpenAI obsahuje neslyšitelný vodoznak vložený přímo do zvukové stopy. |
Dostupnost se může lišit podle produktu, modelu, způsobu exportu, typu souboru a data vytvoření obsahu.
Proč některé typy obsahu používají jiné signály původu?
Různé formáty médií uchovávají informace o původu různými způsoby.
Metadata, například C2PA Content Credentials, mohou obsahovat podrobnější informace, ale platformy, editační nástroje nebo převody souborů je někdy mohou odstranit.
Vodoznaky, jako je SynthID, jsou vloženy přímo do vytvořených médií a mohou lépe odolávat některým transformacím. Vodoznaky však obvykle poskytují méně kontextu než metadata.
Pokud je to technicky možné, vhodné použití obou přístupů pomáhá zajistit spolehlivější signály původu.
Jak mohu do obrázku vytvořeného pomocí nástrojů OpenAI přidat viditelný vodoznak?
U obrázků vytvořených pomocí ChatGPT, Codexu a rozhraní OpenAI API můžete model požádat, aby přidal viditelné označení. Při vytváření obrázku můžete například zadat: „Include a visible OpenAI watermark in the image.“
Viditelné vodoznaky jsou oddělené od vložených signálů původu, jako jsou metadata C2PA a vodoznaky SynthID. Mohou divákům pomoci rozpoznat, že byl obrázek vytvořen pomocí nástrojů OpenAI, ale nejsou totéž jako strojově čitelné signály původu.
Jak mohu ověřit, zda byl obsah vytvořen pomocí nástrojů OpenAI?
Na webu openai.com/verify můžete zkontrolovat, zda podporovaný obrázek nebo zvukový soubor obsahuje signály původu spojené s obsahem vytvořeným či exportovaným pomocí nástrojů OpenAI.
Po nahrání podporovaného souboru nástroj vyhledá podporované signály původu OpenAI, například vodoznak SynthID nebo důvěryhodný manifest C2PA spojený s OpenAI.
Pokud nástroj najde podporovaný signál původu OpenAI, znamená to, že byl obsah vytvořen nebo exportován pomocí nástrojů OpenAI.
Co znamená výsledek ověření?
Pokud je rozpoznán signál, nástroj může pomoci potvrdit, že nahraný obsah obsahuje podporovaný signál původu spojený s OpenAI.
Nástroj nepotvrzuje, že je obsah přesný, neupravený, v zákonném vlastnictví nebo prezentovaný ve správném kontextu. Neurčuje ani to, kdo obsah vytvořil nebo proč.
Co když se žádný signál nenajde?
Pokud není rozpoznán žádný signál, znamená to, že nástroj v nahraném souboru nenašel signály původu vydané OpenAI.
Obsah přesto mohl být vytvořen nebo exportován pomocí OpenAI, pokud:
Byl vytvořen dříve, než byly signály původu k dispozici.
Pochází z nepodporovaného produktu či modelu nebo byl exportován nepodporovaným způsobem či do nepodporovaného typu souboru.
Metadata byla odstraněna při nahrávání, stahování, úpravách, převodu nebo sdílení.
Vodoznak byl narušen kompresí, oříznutím, šumem, úpravami, převodem formátu nebo jinými transformacemi.
Zvukový klip je příliš krátký nebo byl výrazně upraven.
Plánujete podporovat textové výstupy?
V souladu s našimi závazky vyplývajícími z Kodexu zásad Evropské komise pro transparentnost obsahu vytvořeného AI chceme rozšířit signály původu na všechny modality včetně textu. Zákazníci a vývojáři tak budou mít jasné možnosti, jak plnit vlastní povinnosti v oblasti transparentnosti, zatímco se standardy a nástroje budou dále vyvíjet.
Dokáže OpenAI Verify rozpoznat obsah z jiných nástrojů AI?
OpenAI Verify je určen k rozpoznávání podporovaných signálů původu spojených s obsahem vytvořeným nebo exportovaným pomocí nástrojů OpenAI.
Není určen k rozpoznávání obsahu vytvořeného jinými službami AI. Nemusí také rozpoznat obsah vytvořený pomocí OpenAI, pokud příslušný signál chybí, není podporován nebo byl narušen.
Mohou vývojáři ověřovat obsah pomocí API?
Vývojáři a organizace mohou pomocí ověřovacího API OpenAI kontrolovat podporovaný obsah na přítomnost signálů původu OpenAI a začlenit ověřování do vlastních aplikací nebo pracovních postupů. Informace o přístupu k API najdete na webu openai.com/verify. Organizace, které potřebují vyšší limity využití, mohou požádat o jejich navýšení. Další informace najdete na webu openai.com/verify.
