OpenAI izmanto tādus izcelsmes signālus kā SynthID ūdenszīmes un Content Credentials (C2PA), lai palīdzētu cilvēkiem saprast, vai saturs ir ģenerēts ar OpenAI rīkiem. Izcelsmes signāli var būt noderīgas izcelsmes norādes, taču tie negarantē, ka saturs ir precīzs, nerediģēts, likumīgi pieder tā īpašniekam vai ir pasniegts pareizajā kontekstā.
Kas ir C2PA standarts, un ko tas nodrošina?
C2PA ir atvērts tehniskais standarts, kas izdevējiem, uzņēmumiem un citiem ļauj multivides saturā iegult metadatus, lai pārbaudītu tā izcelsmi un saistīto informāciju. C2PA nav paredzēts tikai MI ģenerētam saturam. Šo standartu ievieš arī kameru ražotāji, ziņu organizācijas un citi, lai apliecinātu multivides satura avotu un vēsturi jeb izcelsmi.
C2PA metadatos var būt tāda informācija kā faila izveidei izmantotais rīks vai pakalpojums, tā izveides laiks un cita informācija par faila izcelsmi vai vēsturi.
Uzziniet vairāk par C2PA.
Kas ir SynthID, un ko tas nodrošina?
SynthID ir neredzama ūdenszīmju tehnoloģija, kas signālu iegulst tieši ģenerētajā multivides saturā. Atšķirībā no metadatiem signāls ir daļa no paša satura un var saglabāties pēc noteiktiem labojumiem vai pārveidojumiem.
SynthID līdztekus C2PA metadatiem nodrošina papildu izcelsmes signālu. Piemēram, ja no faila tiek noņemti metadati, iegultā ūdenszīme joprojām var liecināt, ka saturs ģenerēts ar atbalstītiem OpenAI rīkiem.
Kāda veida OpenAI ģenerētajam saturam ir izcelsmes signāli?
Dažādiem satura veidiem OpenAI izmanto atšķirīgus izcelsmes signālus.
| Satura veids | Izcelsmes signāli | Piezīmes |
|---|---|---|
| Attēli | C2PA metadati un SynthID ūdenszīmes | Atbalstītajiem attēliem, kas ģenerēti ar ChatGPT, Codex un OpenAI API, ir abi signāli. |
| Audio | SynthID ūdenszīmes | Atbalstītajā OpenAI ģenerētajā audio saturā ir iegulta nedzirdama ūdenszīme. |
Pārklājums var atšķirties atkarībā no produkta, modeļa, eksportēšanas veida, faila tipa un satura izveides laika.
Kāpēc dažādiem satura veidiem izmanto atšķirīgus izcelsmes signālus?
Dažādi multivides formāti izcelsmes informāciju saglabā atšķirīgos veidos.
Metadatos, piemēram, C2PA Content Credentials, var ietvert detalizētāku informāciju, taču platformas, rediģēšanas rīki vai failu konvertēšana dažkārt tos var noņemt.
Ūdenszīmes, piemēram, SynthID, tiek iegultas pašā ģenerētajā multivides saturā un var labāk saglabāties pēc noteiktiem pārveidojumiem. Tomēr ūdenszīmes parasti sniedz mazāk konteksta nekā metadati.
Ja tas ir tehniski iespējams, abu pieeju atbilstoša izmantošana palīdz nodrošināt uzticamākus izcelsmes signālus.
Kā ar OpenAI rīkiem ģenerētam attēlam pievienot redzamu ūdenszīmi?
Varat pieprasīt, lai attēliem, kas ģenerēti ar ChatGPT, Codex un OpenAI API, tiktu pievienota redzama norāde. Lai to izdarītu, dodiet modelim attiecīgu uzvedni. Piemēram, ģenerējot attēlu, varat norādīt: “Include a visible OpenAI watermark in the image.”
Redzamās ūdenszīmes nav tas pats, kas iegultie izcelsmes signāli, piemēram, C2PA metadati un SynthID ūdenszīmes. Tās var palīdzēt skatītājiem saprast, ka attēls ģenerēts ar OpenAI rīkiem, taču tās nav tas pats, kas mašīnlasāmi izcelsmes signāli.
Kā pārbaudīt, vai saturs ģenerēts ar OpenAI rīkiem?
Varat apmeklēt openai.com/verify, lai pārbaudītu, vai atbalstītā attēlā vai audio failā ir izcelsmes signāli, kas saistīti ar OpenAI rīkos ģenerētu vai no tiem eksportētu saturu.
Pēc atbalstīta faila augšupielādes rīks meklēs atbalstītus OpenAI izcelsmes signālus, piemēram, SynthID ūdenszīmi vai ar OpenAI saistītu uzticamu C2PA deklarāciju.
Ja rīks atrod atbalstītu OpenAI izcelsmes signālu, tas norāda, ka saturs ir ģenerēts ar OpenAI rīkiem vai eksportēts no tiem.
Ko nozīmē pārbaudes rezultāts?
Ja tiek noteikts signāls, rīks var palīdzēt apstiprināt, ka augšupielādētajā saturā ir atbalstīts ar OpenAI saistīts izcelsmes signāls.
Rīks neapstiprina, ka saturs ir precīzs, nerediģēts, likumīgi pieder tā īpašniekam vai ir pasniegts pareizajā kontekstā. Tas arī nenosaka, kurš saturu izveidoja vai kādēļ tas tika izveidots.
Ko nozīmē tas, ka signāls nav atrasts?
Ja signāls netiek noteikts, rīks augšupielādētajā failā nav atradis OpenAI izdotus izcelsmes signālus.
Saturs tomēr var būt ģenerēts ar OpenAI rīkiem vai eksportēts no tiem, ja:
saturs tika izveidots, pirms kļuva pieejami izcelsmes signāli;
saturs iegūts no neatbalstīta produkta, modeļa, eksportēšanas veida vai faila tipa;
metadati tika noņemti augšupielādes, lejupielādes, rediģēšanas, konvertēšanas vai kopīgošanas laikā;
ūdenszīmi sabojāja saspiešana, apgriešana, troksnis, labojumi, formāta maiņa vai citi pārveidojumi;
audio fragments ir pārāk īss vai būtiski pārveidots.
Vai plānojat atbalstīt teksta izvadi?
Saskaņā ar mūsu saistībām, ko paredz Eiropas Komisijas prakses kodekss par MI ģenerēta satura pārredzamību, mūsu mērķis ir paplašināt izcelsmes signālu lietojumu, aptverot visas modalitātes, tostarp tekstu. Tādējādi klientiem un izstrādātājiem būs skaidri veidi, kā izpildīt savus pārredzamības pienākumus, turpinot pilnveidoties standartiem un rīkiem.
Vai OpenAI Verify var noteikt ar citiem MI rīkiem radītu saturu?
OpenAI Verify ir paredzēts, lai noteiktu atbalstītos izcelsmes signālus, kas saistīti ar OpenAI rīkos ģenerētu vai no tiem eksportētu saturu.
Tas nav paredzēts citu MI pakalpojumu ģenerēta satura noteikšanai un var arī neatpazīt OpenAI ģenerētu saturu, ja attiecīgā signāla nav, tas netiek atbalstīts vai ir bojāts.
Vai izstrādātāji var pārbaudīt saturu, izmantojot API?
Izstrādātāji un organizācijas var izmantot OpenAI pārbaudes API, lai atbalstītajā saturā meklētu OpenAI izcelsmes signālus un integrētu pārbaudi savās lietotnēs vai darbplūsmās. Informācija par piekļuvi API ir pieejama vietnē openai.com/verify. Organizācijas, kurām nepieciešami lielāki lietošanas ierobežojumi, var pieteikties to palielināšanai. Plašāka informācija pieejama vietnē openai.com/verify.
