概覽
什麼是 ChatGPT 語音?
ChatGPT 語音可讓你與 ChatGPT 說話,並聽到語音回應。語音會在對話中運作,因此你可以一邊聆聽一邊閱讀文字回應、在不方便說話時改用輸入,也能查看先前訊息而不必重新開始。
如果你想將單段錄音轉成可編輯文字,請改用 ChatGPT 聽寫。
Live 選項可以同時聆聽和說話,讓輪流發言和插話感覺更自然。Live 也能使用網頁搜尋和記憶、透過支援的小工具顯示視覺結果,並在你的帳戶可用時處理文字和圖片。
ChatGPT 可能會出錯。請查核重要資訊,特別是與日期、時間或地點相關的問題。語音會使用你裝置或瀏覽器的時區來理解「今天」或「明天」等詞。如果答案似乎不正確,請檢查你的時區,或在問題中加入確切日期、時區或地點。進一步了解 ChatGPT 與準確性。
有哪些語音選項?
您可能會在設定 → 語音下看到以下選項:
即時模式會依您的方案採用 GPT-Live-1 或 GPT-Live-1 mini。即時模式專為自然流暢的雙向對話而設計,可使用網頁搜尋和記憶功能、透過支援的小工具顯示視覺化結果,並在同一個對話中處理文字與圖片。即時模式目前不支援視訊、螢幕分享、已連結的應用程式或外掛程式。
進階:先前的即時語音體驗。如需使用視訊或螢幕分享等支援的行動裝置功能,請使用進階模式。
標準:逐輪進行的語音體驗,會先將您的語音轉錄成文字,再產生回覆。
您可使用的選項可能取決於方案、工作區設定、地區、應用程式版本及家長控制。若青少年帳戶已連結,家長或監護人可透過家長控制管理語音功能的使用權限。
若要切換可用選項,請開啟設定 → 語音,然後選取即時、進階或標準。
Business、Enterprise、Edu 和 Healthcare 工作區的可用情況
符合資格的 Business、Enterprise、Edu 和 Healthcare 工作區可使用 ChatGPT 語音,但仍受工作區設定約束。
目前提供兩種語音體驗:
對話中的語音:透過自然的即時對話提問、集思廣益並探索想法。對話中的語音由 GPT-Live 提供技術支援,可在網頁版、iOS 和 Android 上使用。
桌面版語音:使用語音啟動任務、查看進度、詢問代理程式相關問題,並透過單一對話協調多個代理程式。可在 macOS 和 Windows 版 ChatGPT 桌面應用程式中使用,並支援配對的遠端存取。
在 Enterprise、Edu 和 Healthcare 工作區中,當工作區擁有者啟用語音時,即時模式會成為預設的語音體驗。不需要啟用搶先使用模型。工作區擁有者可以停用語音,以完全關閉語音功能。
使用限制
對話中的語音
在對話模式中,即時模式的用量採 24 小時滾動週期計算。達到限制時,ChatGPT 會通知您。
| 方案 | 用量 |
|---|---|
| 免費版 | 可有限度使用 GPT-Live-1 mini。限制可能有所調整。 |
| Go | GPT-Live-1 mini 可使用 3 小時 |
| Plus | GPT-Live-1 可使用 3 小時 |
| Pro(每月 $100) | GPT-Live-1 可使用 15 小時 |
| Pro(每月 $200) | 無限使用 GPT-Live-1 |
| Business Standard | GPT-Live-1 可使用 3 小時。額外用量每分鐘會消耗 1.25 點數。 |
| Business Premium | GPT-Live-1 可使用 15 小時。額外用量每分鐘會消耗 1.25 點數。 |
| K–12 教師 | GPT-Live-1 可使用 3 小時 |
| 採點數計價的 Enterprise、Edu 和臨床醫師方案 | 每分鐘 1.25 點數 |
| 採用量制美元計價的 Enterprise | 每分鐘 $0.05 |
| 舊版 Enterprise 和 Edu 方案 | GPT-Live-1 可使用 3 小時 |
桌面版語音
如需瞭解目前的可用情況、方案額度及使用限制,請參閱ChatGPT 桌面版語音定價與限制。
開始語音對話
在 iOS 和 Android 上
選取訊息列中的 語音 圖示。
如果系統提示,請允許 ChatGPT 應用程式存取你的麥克風。
如果這是你的第一次語音對話,請選擇偏好的語音。
語音開啟後,開始說話即可開始對話。
對話期間,選取麥克風控制項即可將自己靜音或取消靜音。選取結束控制項即可結束語音對話。
在網頁上
前往 ChatGPT.com。
選取提示詞視窗中的 語音 圖示。
如果系統提示,請允許瀏覽器存取你的麥克風。
語音開啟後,開始說話即可開始對話。
對話期間,選取麥克風控制項即可將自己靜音或取消靜音。選取結束控制項即可結束語音對話。
在 Live 中使用文字和圖片
Live 可以在與語音對話相同的對話中接收文字和圖片。語音啟用時,可使用訊息列中的新增按鈕附加可用圖片,或改為輸入訊息而不說話。ChatGPT 可以用語音回應,而不必開始另一個對話。
可用的圖片類型和限制取決於你的方案和帳戶。
Live 目前無法從你的 ChatGPT Library 尋找或新增檔案。視你的帳戶而定,你仍可能可以手動將支援的檔案附加到對話。
分享視訊或螢幕
即時模式不支援視訊或螢幕分享。
符合資格的訂閱者在 ChatGPT iOS 和 Android 應用程式中使用進階模式時,仍可使用視訊和螢幕分享功能:
若要分享即時視訊,請在語音對話期間選取相機按鈕。再次選取該按鈕即可停止分享。
若要分享螢幕,請選取「更多選項」選單,再選取分享螢幕,然後依照裝置上的提示操作。
若要停止分享螢幕,請返回 ChatGPT,然後再次選取螢幕分享控制項。您也可以透過裝置的系統螢幕分享控制項停止分享。
如果達到視訊或螢幕分享限制,您或許仍可繼續語音對話,而不必開始新的視訊或螢幕分享輸入。
變更偏好的語音
開啟「設定」→「語音」,然後選取「語音」,即可從以下選項中選擇:
Arbor — 隨和且多變
Breeze — 生動且真誠
Cove — 沉著且直率
Ember — 自信且樂觀
Juniper — 坦率且開朗
Maple — 愉快且坦誠
Sol — 機敏且放鬆
Spruce — 沉穩且給人肯定
Vale — 活潑且好奇
在巴西,你可能也會看到以下語音:
Viola — 輕快、自然且好奇
Rio — 溫暖、親切且樂於助人
在語音對話期間變更所選語音,會在同一個對話中開始新的語音通話。
變更偏好的語言
開啟 設定 → 語音,然後選取 語言。選擇你最常說的語言,有助於 ChatGPT 更準確地理解你的語音。你也可以在語音對話期間要求 ChatGPT 說另一種語言。
變更回應風格
預設的 ChatGPT 人格目前不適用於 Live。
在個別語音對話期間,你仍可要求 ChatGPT 改變語氣、速度或回應風格。
你可以要求 ChatGPT 說快一點或慢一點,但目前無法精確控制播放速度。
在 CarPlay 中使用語音
ChatGPT 可在支援的 iPhone 上透過 Apple CarPlay 使用。你可以從 CarPlay 螢幕開始語音對話、繼續最近或已釘選的對話,或在專案中開始對話。進一步了解如何在 CarPlay 中使用 ChatGPT。
僅在法律允許且情況適合安全使用時,才使用你的行動裝置。請在駕駛前設定好應用程式,並避免在車輛行進中操作裝置。
讓對話在背景中持續進行
若要在使用其他應用程式或手機鎖定時繼續語音對話,請在 設定 → 語音 下開啟 背景對話。
當你結束對話、強制關閉應用程式、達到使用量限制或達到最長工作階段長度時,背景對話會結束。如果你在進階中分享螢幕,當你停止分享或鎖定螢幕時,螢幕分享也會結束。
使用語音啟動 ChatGPT
在支援的行動應用程式版本中,於 設定 → 語音 下開啟 以語音開始。開啟此設定後,當你在 ChatGPT 開啟新的或空白對話時,語音會自動開始。
若要在 CarPlay 中自動開始語音,請在 設定 → 語音 下開啟 在 CarPlay 中自動開始。此設定會在你於 CarPlay 中使用過 ChatGPT 後出現。
資料控制項
OpenAI 會保留音訊和影片片段多久?
Live 和進階語音對話的音訊片段,以及進階語音對話的影片片段,會與顯示在對話記錄中的逐字稿一併儲存。片段會保留 30 天。
當你刪除對話時,我們也會在 30 天內刪除其相關音訊和影片片段,除非基於我們的隱私權政策所述的安全、保障或法律原因需要保留,或除非你先前已選擇分享片段以協助訓練我們的模型,且這些片段已與你的帳戶解除關聯。
刪除對話(包括相關音訊或影片資料)後無法復原。封存只會從側邊欄移除對話;不會刪除該對話或其相關音訊或影片片段。
使用標準時,音訊會在 ChatGPT 產生回應前先轉錄。轉錄完成後,我們會刪除音訊,除非你已選擇分享音訊以協助訓練我們的模型。即使轉錄失敗,音訊也會被刪除。
OpenAI 會使用音訊或影片片段來訓練模型嗎?
除非你選擇分享音訊或影片片段以協助訓練我們的模型,或你已在 OpenAI 帳戶設定中啟用「包含你的錄音」或「包含你的錄影」切換開關,否則不會。你可以在這裡進一步了解你的資料控制項。
如果已開啟 為所有人改進模型,我們可能會依你的方案和設定,使用語音對話的逐字稿和其他檔案來訓練我們的模型。除非你如上所述選擇分享相關音訊或影片片段以改進模型,否則我們不會將其用於訓練。
個人工作區中的免費版、Plus 和 Pro 使用者可以開啟 設定 → 資料控制項、啟用 為所有人改進模型,再啟用 包含你的錄音 或 包含你的錄影,以選擇分享片段。使用者無法分享 ChatGPT Business、Enterprise 或 Edu 工作區中語音對話的音訊或影片片段。
如果你選擇分享音訊或影片片段,我們的團隊可能會審查分享的片段,以協助改進模型行為,例如了解 ChatGPT 在哪些地方聽錯或誤解。在使用分享片段進行訓練之前,我們會採取措施減少片段中的個人資訊量。
如果你停止分享,新的片段將不再用於訓練我們的模型。先前已與你的帳戶解除關聯的片段可能會繼續使用。你的選擇會綁定到你的帳戶,並套用於你登入的每部裝置。
常見問題
我可以在 ChatGPT 說話時開口嗎?
可以。Live 可以同時聆聽和說話,因此你可以在 ChatGPT 回應時打斷或繼續說話。ChatGPT 應會依循對話的最新部分,但語音重疊、背景噪音、網路狀況和麥克風設定都可能影響它聽到的內容。
可以有多人同時對 ChatGPT 說話嗎?
Live 主要是為一對一對話而設計。它可以處理背景噪音,但尚未針對多位說話者的對話最佳化。當人們彼此交談而不是對 ChatGPT 說話時,它仍可能回應。
為什麼 ChatGPT 會打斷我或停止說話?
仍可能發生中斷,尤其是在有背景噪音、長時間停頓,或其他說話者發出聲音時。請嘗試使用耳機、移到較安靜的環境,或提高裝置音量。在 iPhone 上,你也可以在語音對話期間開啟控制中心,選取 麥克風模式,並開啟 語音隔離。
我可以請語音在我出聲思考時等待嗎?
在對話開始時,你可以請 Live 等到你準備好要它回應,例如:「等我請你回應再回應。」長時間停頓、背景人聲或其他聲音仍可能導致 Live 回應。
何時應該使用語音而不是聽寫?
若要進行即時來回對話或討論想法,請使用語音。當你想錄製提示詞、檢閱並編輯其轉錄內容,再以文字傳送時,請使用 ChatGPT 聽寫。語音逐字稿不是逐字記錄,可能不會與實際說出的內容完全相符。
為什麼逐字稿與對話不完全相符?
語音對話後,逐字稿會加入對話中。它可能不會與你或 ChatGPT 所說的內容完全相符,尤其是在語音重疊、有背景噪音,或對話進行得很快時。
使用 Live 時,ChatGPT 回應也會在說出時以文字顯示在對話中。結束語音對話後,你可以在對話記錄中查看該對話。
語音對話包含字幕嗎?
使用 Live 時,ChatGPT 回應會在說出時以文字顯示在對話中。在 iOS 和 Android 上使用進階時,請在語音對話期間選取 cc 按鈕,以顯示 ChatGPT 回應的字幕。
結束語音對話後,逐字稿會加入對話中,讓你可在對話記錄中查看。
為什麼我的語音對話結束了?
當你達到使用量限制、最長工作階段長度,或長對話達到其內容脈絡限制時,語音對話可能會結束。在可行時,ChatGPT 會顯示通知。你可以改用文字繼續,或再次開始語音。
我一次可以進行幾個語音對話?
你一次只能進行一個語音對話。
