OpenAI は、コンテンツが OpenAI のツールで生成されたものかどうかを判断する手掛かりとして、SynthID ウォーターマークや Content Credentials(C2PA)などの来歴シグナルを使用しています。来歴シグナルは出所を判断するうえで役立つ指標ですが、コンテンツの正確性、未編集であること、法的な所有権、適切な文脈で提示されていることを保証するものではありません。
C2PA 標準の概要と実現できること
C2PA は、パブリッシャーや企業などがメディアにメタデータを埋め込み、その出所や関連情報を検証できるようにするオープンな技術標準です。C2PA は、AI 生成コンテンツだけを対象とするものではありません。カメラメーカーや報道機関なども、メディアコンテンツの出所や履歴、すなわち来歴を証明するために同じ標準を採用しつつあります。
C2PA メタデータには、ファイルの作成に使用されたツールやサービス、作成日時、出所や履歴に関するその他の詳細情報を含めることができます。
詳しくは C2PA をご覧ください。
SynthID の概要と実現できること
SynthID は、生成されたメディアにシグナルを直接埋め込む、目に見えないウォーターマーク技術です。メタデータとは異なり、このシグナルはコンテンツ自体の一部であるため、一部の編集や変換を経ても残る場合があります。
SynthID は、C2PA メタデータに加えて、もう一つの来歴シグナルを提供します。たとえば、ファイルからメタデータが削除されても、埋め込まれたウォーターマークによって、対応する OpenAI ツールで生成されたコンテンツであることを示せる場合があります。
来歴シグナルが含まれる OpenAI 生成コンテンツの種類
OpenAI は、コンテンツの種類に応じて異なる来歴シグナルを使用しています。
| コンテンツの種類 | 来歴シグナル | 注記 |
|---|---|---|
| 画像 | C2PA メタデータと SynthID ウォーターマーク | ChatGPT、Codex、OpenAI API で生成された対応画像には、両方のシグナルが含まれます。 |
| 音声 | SynthID ウォーターマーク | 対応する OpenAI 生成音声には、人には聞こえないウォーターマークが音声自体に埋め込まれています。 |
対応状況は、製品、モデル、エクスポート方法、ファイル形式、コンテンツの作成時期によって異なる場合があります。
コンテンツの種類によって来歴シグナルが異なる理由
来歴情報の保持方法は、メディア形式によって異なります。
C2PA Content Credentials などのメタデータには、より詳細な情報を含められますが、プラットフォーム、編集ツール、ファイル変換によって削除されることがあります。
SynthID などのウォーターマークは、生成されたメディア自体に埋め込まれるため、一部の変換を経ても残りやすい場合があります。ただし、一般にウォーターマークから得られる文脈情報は、メタデータよりも限定的です。
技術的に可能な場合は、状況に応じて両方の方法を併用することで、より確かな来歴シグナルを提供できます。
OpenAI ツールで生成した画像に可視ウォーターマークを追加する方法
ChatGPT、Codex、OpenAI API で画像を生成する際、可視表示を含めるようモデルにプロンプトで指示できます。たとえば画像を生成する際に、「画像に目に見える OpenAI ウォーターマークを入れてください」と指示できます。
可視ウォーターマークは、C2PA メタデータや SynthID ウォーターマークなどの埋め込み型来歴シグナルとは別のものです。可視ウォーターマークは、その画像が OpenAI ツールで生成されたことを閲覧者が認識するのに役立つ場合がありますが、機械可読の来歴シグナルとは異なります。
OpenAI ツールで生成されたコンテンツかどうかを確認する方法
openai.com/verify では、対応する画像や音声ファイルに、OpenAI ツールで生成またはエクスポートされたコンテンツに関連する来歴シグナルが含まれているかを確認できます。
対応ファイルをアップロードすると、SynthID ウォーターマークや、OpenAI に関連付けられた信頼できる C2PA マニフェストなど、対応する OpenAI の来歴シグナルが検索されます。
対応する OpenAI の来歴シグナルが見つかった場合、そのコンテンツが OpenAI ツールで生成またはエクスポートされたことを示します。
検証結果が示すこと
シグナルが検出された場合、アップロードしたコンテンツに、OpenAI に関連する対応済みの来歴シグナルが含まれていることを確認できます。
このツールは、コンテンツの正確性、未編集であること、法的な所有権、適切な文脈で提示されていることを確認するものではありません。また、コンテンツの作成者や作成理由を特定するものでもありません。
シグナルが見つからない場合
シグナルが検出されなかった場合、アップロードしたファイルから OpenAI が発行した来歴シグナルが見つからなかったことを意味します。
ただし、次のような場合は、OpenAI で生成またはエクスポートされたコンテンツである可能性があります。
来歴シグナルの提供開始前にコンテンツが作成された
対応していない製品、モデル、エクスポート方法、ファイル形式から取得したコンテンツである
アップロード、ダウンロード、編集、変換、共有の過程でメタデータが削除された
圧縮、切り抜き、ノイズ、編集、形式変換、その他の処理によってウォーターマークが劣化した
音声クリップが短すぎるか、大幅に変更されている
テキスト出力への対応予定
欧州委員会の「AI 生成コンテンツの透明性に関する行動規範」に基づく OpenAI の取り組みに沿って、標準やツールが成熟していく中で、お客様や開発者が自らの透明性義務を果たすための明確な手段を得られるよう、テキストを含むすべてのモダリティに来歴シグナルを拡大することを目指しています。
OpenAI Verify で他の AI ツールのコンテンツを検出できるか
OpenAI Verify は、OpenAI ツールで生成またはエクスポートされたコンテンツに関連する、対応済みの来歴シグナルを検出するよう設計されています。
他の AI サービスで生成されたコンテンツの検出を目的としたものではありません。また、関連するシグナルが欠落している、対応していない、または劣化している場合は、OpenAI 生成コンテンツも検出できないことがあります。
開発者による API を使用したコンテンツ検証
開発者や組織は OpenAI の検証 API を使用して、対応コンテンツに OpenAI の来歴シグナルが含まれているかを確認し、自社のアプリケーションやワークフローに検証機能を組み込めます。API アクセスについては、openai.com/verify をご覧ください。より高い利用上限が必要な組織は、上限引き上げを申請できます。詳しくは openai.com/verify をご覧ください。
