概覽
甚麼是 ChatGPT 語音?
ChatGPT 語音讓你與 ChatGPT 交談,並聽取語音回應。語音在對話中運作,因此你可以一邊聆聽一邊查看文字回應;不方便說話時可以打字;亦可查看較早前的訊息,而毋須重新開始。
如果你想將單一錄音轉成可編輯文字,請改用 ChatGPT 聽寫。
Live 選項可同時聆聽和說話,讓輪流發言和打斷對話感覺更自然。Live 亦可使用網絡搜尋和記憶功能,透過支援的小工具顯示視覺結果,並在你的帳戶可使用相關功能時處理文字和圖像。
ChatGPT 可能會出錯。請核實重要資訊,特別是與日期、時間或地點相關的問題。語音會使用你裝置或瀏覽器的時區來理解「今天」或「明天」等字眼。如果答案看起來不準確,請檢查你的時區,或在問題中加入確實日期、時區或地點。進一步了解 ChatGPT 與準確性。
有哪些語音選項?
在設定 → 語音下,你可能會看到以下選項:
Live 由 GPT-Live-1 或 GPT-Live-1 mini 提供支援,視乎你的方案而定。Live 專為自然流暢的來回對話而設,可使用網絡搜尋及記憶功能、透過支援的小工具顯示視覺化結果,並在同一對話中處理文字和圖像。Live 初期不支援影片、螢幕共享、已連接的應用程式或外掛程式。
進階:先前的即時語音體驗。如需使用影片或螢幕共享等受支援的流動裝置功能,請選用「進階」。
標準:一種逐輪進行的語音體驗,會先將你的語音轉錄成文字,再產生回應。
你可用的選項可能視乎方案、工作區設定、地區、應用程式版本及家長控制而定。如青少年帳戶已連結至家長帳戶,家長或監護人可透過家長控制管理語音功能的存取權限。
如要切換可用選項,請開啟設定 → 語音,然後選擇 Live、進階或標準。
Business、Enterprise、Edu 及 Healthcare 工作區的供應情況
ChatGPT 語音適用於合資格的 Business、Enterprise、Edu 及 Healthcare 工作區,惟須視乎工作區設定。
提供兩種語音體驗:
對話中的語音:以自然的即時對話提問、集思廣益及探索構思。對話中的語音由 GPT-Live 提供支援,可在網頁版、iOS 及 Android 版使用。
桌面版語音:使用語音開始工作、查看進度、詢問有關智能體的問題,並透過單一對話協調多個智能體。可在 macOS 及 Windows 版 ChatGPT 桌面應用程式中使用,並支援配對遙距存取。
在 Enterprise、Edu 及 Healthcare 工作區中,當工作區擁有人啟用語音時,Live 會成為預設語音體驗。無須啟用搶先試用模型。工作區擁有人可停用語音,以完全關閉語音功能。
用量限制
對話中的語音
在對話模式中,Live 用量按滾動式 24 小時週期計算。達到限制時,ChatGPT 會通知你。
| 方案 | 用量 |
|---|---|
| 免費版 | 有限度使用 GPT-Live-1 mini。限制可能會有所變更。 |
| Go | 使用 GPT-Live-1 mini 3 小時 |
| Plus | 使用 GPT-Live-1 3 小時 |
| Pro(每月 100 美元) | 使用 GPT-Live-1 15 小時 |
| Pro(每月 200 美元) | 無限使用 GPT-Live-1 |
| Business 標準版 | 使用 GPT-Live-1 3 小時。額外用量每分鐘消耗 1.25 積分。 |
| Business 進階版 | 使用 GPT-Live-1 15 小時。額外用量每分鐘消耗 1.25 積分。 |
| K–12 教師 | 使用 GPT-Live-1 3 小時 |
| 採用積分制收費的 Enterprise、Edu 及臨床醫護人員方案 | 每分鐘 1.25 積分 |
| 採用美元用量制收費的 Enterprise | 每分鐘 0.05 美元 |
| 舊版 Enterprise 及 Edu 方案 | 使用 GPT-Live-1 3 小時 |
桌面版語音
有關目前的供應情況、方案配額及用量限制,請參閱ChatGPT 桌面版語音的收費及限制。
開始語音對話
在 iOS 和 Android 上
在訊息列中選擇 語音 圖示。
如系統提示,請允許 ChatGPT 應用程式存取你的咪高風。
如果這是你的第一次語音對話,請選擇偏好的語音。
語音開啟後,開始說話以開始對話。
對話期間,選擇咪高風控制項即可將自己靜音或取消靜音。選擇離開控制項以結束語音對話。
在網頁上
前往 ChatGPT.com。
在提示詞視窗中選擇 語音 圖示。
如系統提示,請允許瀏覽器存取你的咪高風。
語音開啟後,開始說話以開始對話。
對話期間,選擇咪高風控制項即可將自己靜音或取消靜音。選擇離開控制項以結束語音對話。
在 Live 中使用文字和圖像
Live 可以在與語音對話相同的對話中接收文字和圖像。語音啟用期間,你可以使用訊息列中的加入按鈕附加可用圖像,或輸入訊息而不是說話。ChatGPT 可以以語音回應,而毋須開始另一個對話。
可用的圖像類型和限制取決於你的計劃和帳戶。
Live 目前無法從你的 ChatGPT Library 尋找或加入檔案。視乎你的帳戶而定,你仍可能可以手動將支援的檔案附加至對話。
共享影片或螢幕
Live 不支援影片或螢幕共享。
合資格訂閱者在 ChatGPT iOS 及 Android 應用程式中使用進階模式時,仍可使用影片及螢幕共享功能:
如要共享即時影片,請在語音對話期間選擇相機按鈕。再次選擇該按鈕即可停止共享。
如要共享螢幕,請選擇「更多選項」選單,然後選擇共享螢幕,並按照裝置上的提示操作。
如要停止共享螢幕,請返回 ChatGPT,然後再次選擇螢幕共享控制項。你亦可透過裝置的系統螢幕共享控制項停止共享。
即使已達影片或螢幕共享限制,你仍可能可以繼續語音對話,而無須開始新的影片或螢幕共享輸入。
更改偏好的語音
開啟設定 → 語音,然後選擇語音,即可從以下選項中挑選:
Arbor — 隨和百變
Breeze — 生動真摯
Cove — 沉着直接
Ember — 自信樂觀
Juniper — 坦率開朗
Maple — 愉快坦誠
Sol — 機敏從容
Spruce — 平靜而充滿支持
Vale — 活潑好奇
在巴西,你可能也會看到以下語音:
Viola — 輕快、率真、好奇
Rio — 溫暖、親切、樂於助人
在語音對話期間變更所選語音,會在同一對話中開始新的語音通話。
更改偏好的語言
開啟 設定 → 語音,然後選擇 語言。選擇你最常說的語言,可幫助 ChatGPT 更準確理解你的語音。你亦可在語音對話期間要求 ChatGPT 使用另一種語言說話。
更改回應風格
預設的 ChatGPT 個性目前不適用於 Live。
你仍可在個別語音對話期間,要求 ChatGPT 更改語氣、節奏或回應風格。
你可以要求 ChatGPT 說快一點或慢一點,但目前未提供精確的播放速度控制。
在 CarPlay 中使用語音
ChatGPT 可在支援的 iPhone 上透過 Apple CarPlay 使用。你可以在 CarPlay 畫面開始語音對話、繼續最近或已置頂的對話,或在專案中開始對話。進一步了解如何在 CarPlay 中使用 ChatGPT。
只應在法律允許且情況適合安全使用時使用流動裝置。請在駕駛前設定好應用程式,並避免在車輛行駛期間操作裝置。
讓對話在背景中繼續
如要在使用其他應用程式或手機鎖定時繼續語音對話,請在 設定 → 語音 下開啟 背景對話。
當你結束對話、強制關閉應用程式、達到使用上限,或達到最長工作階段時間時,背景對話便會結束。如果你在進階中分享螢幕,當你停止分享或鎖定螢幕時,螢幕分享亦會結束。
以語音啟動 ChatGPT
在支援的流動應用程式版本中,於 設定 → 語音 下開啟 以語音開始。開啟此設定後,當你在 ChatGPT 開啟新的或空白的對話時,語音會自動開始。
如要在 CarPlay 中自動啟動語音,請在 設定 → 語音 下開啟 在 CarPlay 中自動開始。你在 CarPlay 中使用過 ChatGPT 後,此設定便會顯示。
資料控制
OpenAI 會保留音訊和影片片段多久?
Live 和進階語音對話的音訊片段,以及進階語音對話的影片片段,會與顯示在對話記錄中的逐字稿一併儲存。片段會保留 30 天。
當你刪除對話時,我們亦會在 30 天內刪除其相關音訊和影片片段,除非我們需要按私隱政策所述,基於保安、安全或法律原因保留,或除非你先前已選擇分享片段以協助訓練我們的模型,而該等片段已與你的帳戶解除關聯。
刪除對話(包括相關音訊或影片資料)後無法復原。封存只會將對話從側邊欄移除;不會刪除對話或其相關音訊或影片片段。
使用標準時,音訊會先轉錄,然後 ChatGPT 才會生成回應。轉錄完成後,我們會刪除音訊,除非你已選擇分享音訊以協助訓練我們的模型。即使轉錄失敗,音訊亦會被刪除。
OpenAI 會使用音訊或影片片段訓練模型嗎?
不會,除非你選擇分享音訊或影片片段以協助訓練我們的模型,或你在 OpenAI 帳戶設定中啟用了「包含你的音訊錄音」或「包含你的影片錄影」切換。你可以在這裏進一步了解你的資料控制。
如果已開啟 為所有人改進模型,視乎你的計劃和設定,我們可能會使用你語音對話中的逐字稿和其他檔案來訓練我們的模型。除非你如上所述選擇分享相關音訊或影片片段以改進模型,否則我們不會將其用於訓練。
個人工作區中的 Free、Plus 和 Pro 用戶可開啟 設定 → 資料控制,啟用 為所有人改進模型,再啟用 包含你的音訊錄音 或 包含你的影片錄影,以選擇分享片段。用戶無法分享 ChatGPT Business、Enterprise 或 Edu 工作區中語音對話的音訊或影片片段。
如果你選擇分享音訊或影片片段,我們的團隊可能會審查已分享的片段,以協助改進模型行為,例如了解 ChatGPT 在哪些情況下聽錯或誤解內容。在使用已分享的片段進行訓練之前,我們會採取措施減少片段中的個人資料量。
如果你停止分享,新的片段將不再用於訓練我們的模型。先前已與你的帳戶解除關聯的片段可能會繼續使用。你的選擇與你的帳戶相關,並適用於你登入的每部裝置。
常見問題
ChatGPT 說話時,我可以同時說話嗎?
可以。Live 可以同時聆聽和說話,因此你可以在 ChatGPT 回應時打斷或繼續說話。ChatGPT 應會跟隨對話的最新部分,但語音重疊、背景噪音、網絡狀況和咪高風設定都可能影響它聽到的內容。
多人可以同時與 ChatGPT 說話嗎?
Live 主要設計用於一對一對話。它可以處理背景噪音,但尚未針對多人說話的對話進行優化。當人們彼此交談而不是對 ChatGPT 說話時,它可能會作出回應。
為甚麼 ChatGPT 會打斷我或停止說話?
仍然可能出現打斷情況,尤其是在有背景噪音、長時間停頓,或有其他說話者的聲音時。你可以嘗試使用耳機、移到較安靜的環境,或調高裝置音量。在 iPhone 上,你亦可在語音對話期間開啟控制中心,選擇 咪高風模式,並開啟 語音隔離。
我可以要求語音在我邊想邊說時先等一等嗎?
在對話開始時,你可以要求 Live 等到你準備好接收回應才回應,例如:「等我叫你回應才回應。」長時間停頓、背景說話聲或其他聲音仍可能令 Live 作出回應。
我應何時使用語音而不是聽寫?
如要進行即時雙向對話或透過交談梳理想法,請使用語音。如果你想錄製提示詞、查看並編輯其轉錄文字,然後以文字形式傳送,請使用 ChatGPT 聽寫。語音逐字稿並非逐字記錄,未必完全符合實際說話內容。
為甚麼逐字稿不完全符合對話內容?
語音對話結束後,逐字稿會加入對話。它未必完全符合你或 ChatGPT 所說的內容,尤其是在語音重疊、有背景噪音,或對話進行得很快時。
使用 Live 時,ChatGPT 的回應亦會在說出時同時以文字形式顯示在對話中。語音對話結束後,你可以在對話記錄中查看對話。
語音對話是否包含字幕?
使用 Live 時,ChatGPT 的回應會在說出時同時以文字形式顯示在對話中。在 iOS 和 Android 上使用進階時,可在語音對話期間選擇 cc 按鈕,顯示 ChatGPT 回應的字幕。
語音對話結束後,其逐字稿會加入對話,方便你在對話記錄中查看。
為甚麼我的語音對話結束了?
當你達到使用上限、最長工作階段時間,或長對話達到其上下文限制時,語音對話可能會結束。在可行情況下,ChatGPT 會顯示通知。你可以繼續以文字對話,或重新開始語音。
我可以同時進行多少個語音對話?
你一次只可以進行一個語音對話。
