概要
ChatGPT 音声モードとは?
ChatGPT 音声モードでは、ChatGPT と話し、音声で応答を聞くことができます。音声モードはチャット内で動作するため、応答をテキストで追いながら聞いたり、話せないときに入力したり、最初からやり直さずに以前のメッセージを確認したりできます。
1 件の録音を編集可能なテキストに変換したい場合は、ChatGPT Dictation を使用してください。
Live オプションでは、同時に聞き取りと発話ができるため、発話の交代や割り込みがより自然に感じられます。Live は、アカウントでこれらの機能を利用できる場合、ウェブ検索やメモリの使用、対応ウィジェットによる視覚的な結果の表示、テキストや画像の処理もできます。
ChatGPT は誤りを犯すことがあります。特に日付、時間、場所に左右される質問では、重要な情報を確認してください。音声モードは、「今日」や「明日」などの語句を理解するために、デバイスまたはブラウザのタイムゾーンを使用します。回答がずれているように思える場合は、タイムゾーンを確認するか、質問に正確な日付、タイムゾーン、場所を含めてください。ChatGPT と正確性について詳しく見る。
利用できる音声オプション
設定 → 音声には、次のオプションが表示される場合があります。
Live は、ご利用のプランに応じて GPT-Live-1 または GPT-Live-1 mini を使用します。Live は自然な対話向けに設計されており、ウェブ検索やメモリの利用、対応ウィジェットでの視覚的な結果の表示、同じチャット内でのテキストと画像の利用が可能です。Live は当初、動画、画面共有、接続済みアプリ、プラグインには対応していません。
Advanced:従来のリアルタイム音声機能です。動画や画面共有など、対応するモバイル機能が必要な場合は Advanced を使用してください。
Standard:音声を文字起こししてから応答を生成する、ターン制の音声機能です。
利用できるオプションは、プラン、ワークスペースの設定、地域、アプリのバージョン、ペアレンタルコントロールによって異なる場合があります。連携されたティーンのアカウントでは、保護者がペアレンタルコントロールから音声機能へのアクセスを管理できます。
利用可能なオプションを切り替えるには、設定 → 音声を開き、Live、Advanced、またはStandardを選択します。
Business、Enterprise、Edu、Healthcare ワークスペースでの提供状況
ChatGPT 音声モードは、ワークスペースの設定に応じて、対象となる Business、Enterprise、Edu、Healthcare ワークスペースで利用できます。
次の 2 種類の音声機能を利用できます。
Chat の音声機能:自然なリアルタイムの会話で、質問、ブレインストーミング、アイデアの検討ができます。GPT-Live を使用する Chat の音声機能は、ウェブ、iOS、Android で利用できます。
デスクトップの音声機能:1 つの会話から、音声でタスクを開始し、進捗状況を確認し、エージェントについて質問し、複数のエージェントを連携させることができます。ペアリングしたリモートアクセスを使用して、macOS/Windows 用 ChatGPT デスクトップアプリで利用できます。
Enterprise、Edu、Healthcare ワークスペースでは、ワークスペースの所有者が音声を有効にすると、Live がデフォルトの音声機能になります。モデルへの早期アクセスは必要ありません。ワークスペースの所有者は、音声を無効にして、音声機能を完全にオフにできます。
利用上限
Chat の音声機能
Chat モードでは、Live の利用量は直近 24 時間を対象に計測されます。上限に達すると ChatGPT から通知されます。
| プラン | 利用枠 |
|---|---|
| 無料 | GPT-Live-1 mini を制限付きで利用できます。上限は変更される場合があります。 |
| Go | GPT-Live-1 mini を 3 時間 |
| Plus | GPT-Live-1 を 3 時間 |
| Pro(月額 100 ドル) | GPT-Live-1 を 15 時間 |
| Pro(月額 200 ドル) | GPT-Live-1 を無制限で利用可能 |
| Business Standard | GPT-Live-1 を 3 時間利用できます。追加利用では 1 分あたり 1.25 クレジットを消費します。 |
| Business Premium | GPT-Live-1 を 15 時間利用できます。追加利用では 1 分あたり 1.25 クレジットを消費します。 |
| 幼稚園から高校までの教員 | GPT-Live-1 を 3 時間 |
| クレジット制料金の Enterprise、Edu、Clinicians | 1 分あたり 1.25 クレジット |
| 利用量に応じた米ドル料金の Enterprise | 1 分あたり 0.05 ドル |
| 従来の Enterprise および Edu プラン | GPT-Live-1 を 3 時間 |
デスクトップの音声機能
現在の提供状況、プランごとの利用枠、利用上限については、デスクトップ版 ChatGPT 音声機能の料金をご覧ください。
音声会話の開始
iOS と Android の場合
メッセージバーの音声アイコンを選択します。
求められたら、ChatGPT アプリによるマイクへのアクセスを許可します。
初めての音声会話の場合は、優先する音声を選択します。
音声モードが開いたら、話し始めて会話を開始します。
会話中は、マイクコントロールを選択して自分をミュートまたはミュート解除します。音声会話を終了するには、終了コントロールを選択します。
ウェブの場合
ChatGPT.com にアクセスします。
プロンプトウィンドウの音声アイコンを選択します。
求められたら、ブラウザによるマイクへのアクセスを許可します。
音声モードが開いたら、話し始めて会話を開始します。
会話中は、マイクコントロールを選択して自分をミュートまたはミュート解除します。音声会話を終了するには、終了コントロールを選択します。
Live でテキストと画像を使用
Live では、音声会話と同じチャットでテキストと画像を受け付けることができます。音声モードが有効な間は、メッセージバーの追加ボタンを使用して利用可能な画像を添付するか、話す代わりにメッセージを入力します。ChatGPT は別のチャットを開始せずに音声で応答できます。
利用できる画像の種類と制限は、プランとアカウントによって異なります。
現在、Live は ChatGPT Library からファイルを検索または追加できません。アカウントによっては、対応しているファイルを手動でチャットに添付できる場合があります。
動画または画面の共有
Live は動画や画面共有に対応していません。
対象のサブスクリプション利用者は、ChatGPT の iOS/Android アプリでAdvancedを使用する際、引き続き動画と画面共有を利用できます。
ライブ映像を共有するには、音声会話中にカメラボタンを選択します。共有を停止するには、もう一度選択します。
画面を共有するには、その他のオプションメニューを開き、画面を共有を選択して、デバイスに表示される手順に従います。
画面共有を停止するには、ChatGPT に戻り、画面共有のコントロールをもう一度選択します。デバイスのシステム画面共有コントロールから停止することもできます。
動画または画面共有の上限に達しても、新しい動画や画面共有を開始しなければ、音声会話を続けられる場合があります。
好みの音声の変更
設定 → 音声を開き、音声を選択して、次のオプションから選びます。
Arbor — 親しみやすく多才
Breeze — 生き生きとして誠実
Cove — 落ち着いて率直
Ember — 自信に満ちて前向き
Juniper — オープンで明るい
Maple — 陽気で飾らない
Sol — 機転が利いてリラックスした
Spruce — 穏やかで肯定的
Vale — 明るく好奇心旺盛
ブラジルでは、次の音声も表示される場合があります。
Viola — 軽やかで自然体、好奇心旺盛
Rio — 温かく親しみやすく、頼りになる
音声会話中に選択中の音声を変更すると、同じチャット内で新しい音声通話が開始されます。
優先する言語の変更
設定 → 音声を開き、言語を選択します。最もよく話す言語を選択すると、ChatGPT が音声をより正確に理解しやすくなります。音声会話中に、別の言語で話すよう ChatGPT に依頼することもできます。
応答スタイルの変更
現在、ChatGPT のプリセットのパーソナリティは Live には適用されません。
個別の音声会話中に、口調、話す速さ、応答スタイルの変更を ChatGPT に依頼することはできます。
ChatGPT に話す速度を速くまたは遅くするよう依頼できますが、現在、正確な再生速度コントロールは利用できません。
CarPlay で音声モードを使用
対応している iPhone の Apple CarPlay で ChatGPT を利用できます。CarPlay 画面から、音声会話を開始したり、最近のチャットやピン留めしたチャットを続けたり、プロジェクト内で会話を開始したりできます。CarPlay での ChatGPT の使用について詳しく見る。
モバイルデバイスは、法律で認められ、安全に使用できる状況でのみ使用してください。運転前にアプリを設定し、車両の走行中はデバイスを操作しないでください。
バックグラウンドで会話を継続
他のアプリを使用している間やスマートフォンがロックされている間も音声会話を続けるには、設定 → 音声でバックグラウンド会話をオンにします。
バックグラウンド会話は、ユーザーが終了したとき、アプリを強制終了したとき、使用制限に達したとき、または最大セッション時間に達したときに終了します。Advanced で画面を共有している場合、共有を停止したとき、または画面をロックしたときにも画面共有は終了します。
ChatGPT を音声モードで開始
対応しているモバイルアプリのバージョンでは、設定 → 音声で音声で開始をオンにします。この設定がオンの場合、新規または空の会話で ChatGPT を開くと、音声モードが自動的に開始されます。
CarPlay で音声モードを自動開始するには、設定 → 音声でCarPlay で自動的に開始をオンにします。この設定は、CarPlay で ChatGPT を使用した後に表示されます。
データコントロール
OpenAI は音声クリップと動画クリップをどのくらい保持しますか?
Live および高度な音声モードの会話の音声クリップと、高度な音声モードの会話の動画クリップは、チャット履歴に表示される文字起こしとともに保存されます。クリップは 30 日間保持されます。
チャットを削除すると、当社のプライバシーポリシーに記載されているセキュリティ、安全性、法的理由により保持する必要がある場合、またはモデルのトレーニングに役立てるために以前クリップの共有を選択し、すでにアカウントとの関連付けが解除されている場合を除き、関連する音声クリップと動画クリップも 30 日以内に削除されます。
関連する音声または動画データを含め、チャットの削除は元に戻せません。アーカイブはチャットをサイドバーから削除するだけで、チャットや関連する音声クリップまたは動画クリップを削除するものではありません。
Standard では、ChatGPT が応答を生成する前に音声が文字起こしされます。モデルのトレーニングに役立てるために音声の共有を選択している場合を除き、文字起こしが完了すると音声は削除されます。文字起こしに失敗した場合でも、音声は削除されます。
OpenAI は音声クリップや動画クリップをモデルのトレーニングに使用しますか?
モデルのトレーニングに役立てるために音声クリップまたは動画クリップの共有を選択した場合、または OpenAI アカウント設定で「音声録音を含める」または「動画録画を含める」トグルを有効にした場合を除き、使用しません。データコントロールについて詳しくはこちらをご覧ください。
すべての人のためにモデルを改善するがオンの場合、プランと設定によっては、音声会話の文字起こしやその他のファイルをモデルのトレーニングに使用することがあります。上記のとおり、モデル改善のために共有することを選択しない限り、関連する音声クリップまたは動画クリップをトレーニングに使用することはありません。
個人ワークスペースの Free、Plus、Pro ユーザーは、設定 → データコントロールを開き、すべての人のためにモデルを改善するをオンにしてから、音声録音を含めるまたは動画録画を含めるをオンにすることで、クリップの共有を選択できます。ChatGPT Business、Enterprise、または Edu ワークスペースでは、ユーザーは音声会話の音声クリップや動画クリップを共有できません。
音声クリップまたは動画クリップの共有を選択した場合、ChatGPT が聞き間違えたり解釈を誤ったりした箇所を理解するなど、モデルの動作改善に役立てるため、当社のチームが共有クリップを確認することがあります。共有クリップをトレーニングに使用する前に、クリップ内の個人情報の量を減らすための措置を講じます。
共有を停止すると、新しいクリップは当社のモデルのトレーニングに使用されなくなります。以前にお客様のアカウントとの関連付けが解除されたクリップは、引き続き使用される場合があります。この選択はアカウントに紐づけられ、ログインしているすべてのデバイスに適用されます。
データコントロールについて詳しく見るおよびモデルのパフォーマンス向上のためにデータがどのように使用されるかをご覧ください。
よくある質問
ChatGPT が話している間に話せますか?
はい。Live は同時に聞き取りと発話ができるため、ChatGPT が応答している間に割り込んだり、話し続けたりできます。ChatGPT は会話の最新部分に沿うように動作しますが、発話の重なり、背景音、ネットワーク状況、マイク設定によって、聞き取る内容が影響を受けることがあります。
複数の人が同時に ChatGPT に話しかけられますか?
Live は主に 1 対 1 の会話向けに設計されています。背景音には対応できますが、複数の話者との会話にはまだ最適化されていません。人々が ChatGPT ではなく互いに話しているときに、応答する場合があります。
ChatGPT が割り込んだり、話すのをやめたりするのはなぜですか?
背景音、長い沈黙、別の話者の音声がある場合などは、割り込みが発生することがあります。ヘッドフォンを使用する、より静かな場所に移動する、デバイスの音量を上げるなどをお試しください。iPhone では、音声会話中にコントロールセンターを開き、マイクモードを選択して、声を分離をオンにすることもできます。
考えを声に出している間、音声モードに待ってもらえますか?
会話の開始時に、応答の準備ができるまで待つよう Live に依頼できます。たとえば、「私が答えてと言うまで待ってください」と伝えます。ただし、長い沈黙、背景の話し声、その他の音によって Live が応答する場合があります。
Dictation ではなく音声モードを使うべき場面は?
リアルタイムの双方向の会話や、アイデアを話しながら整理したい場合は音声モードを使用します。プロンプトを録音し、その文字起こしを確認・編集してからテキストとして送信したい場合は、ChatGPT Dictation を使用します。音声モードの文字起こしは逐語記録ではなく、話された内容と完全には一致しない場合があります。
文字起こしが会話と完全に一致しないのはなぜですか?
音声会話の後、文字起こしがチャットに追加されます。特に発話が重なったり、背景音があったり、会話の進行が速かったりする場合、あなたや ChatGPT が話した内容と完全には一致しないことがあります。
Live では、ChatGPT の応答も読み上げられている間にチャット内にテキストとして表示されます。音声会話を終了した後、チャット履歴で会話を確認できます。
音声会話にキャプションはありますか?
Live では、ChatGPT の応答が読み上げられている間、チャット内にテキストとして表示されます。iOS と Android の Advanced では、音声会話中に cc ボタンを選択すると、ChatGPT の応答のキャプションが表示されます。
音声会話を終了すると、その文字起こしがチャットに追加され、チャット履歴で確認できます。
音声会話が終了したのはなぜですか?
音声会話は、使用制限、最大セッション時間、または長い会話のコンテキスト制限に達したときに終了する場合があります。可能な場合、ChatGPT は通知を表示します。テキストで続けるか、音声モードを再開できます。
音声会話は同時にいくつできますか?
音声会話は一度に 1 件まで利用できます。
