生活分享

ChatGPT 語音模式:練英文、口說翻譯與免手打的完整做法

ChatGPT 語音模式是搜「口說 AI」「口譯 AI」的人真正會用到的功能,2026 年 7 月起由 GPT-Live 模型驅動,能同時聽與講。這篇依 OpenAI 官方說明整理它在手機 App 與網頁的開法、免費版與 Go、Plus、Pro 的每日額度、支援語言與開鏡頭的限制,並給練英文口說、旅行口譯、免手打三種情境的做法與可以照唸的開場句,最後說明語音片段保留 30 天、訓練開關在哪裡關。

更新日期: 閱讀時間約 13 分鐘

深色桌面上放著一副耳罩式耳機,旁邊是一支螢幕亮著的白色手機,耳機線連著手機。
圖片:wu yi takeshi2 (CC0)

ChatGPT 的語音模式讓你用講的跟它對話、聽它用講的回答,2026 年 7 月起改由 GPT-Live 系列模型驅動,能一邊聽一邊講,不用等你講完才回應。這篇回答台灣使用者最常問的三件事:拿它練英文口說要怎麼設定、出國能不能當口譯、不想打字時該用聽寫還是語音模式。結論是三種都做得到,關鍵在開場的第一句話怎麼講,以及先知道它的額度、噪音與隱私限制在哪裡。把它當口說 練英文、當口譯 AI 出國用,都從第一句話開始。

接下來會先帶你找到語音模式的入口、看懂免費版與付費版的額度差別,再依序給三種情境的完整做法與可以直接照唸的開場句,最後說明語音會不會被保存、能在哪裡關掉。功能名稱、額度與模型名稱在 2026 年 9 月依 OpenAI 的 help center、發布記錄與官方公告查證;這些內容常改,以官網為準。

語音模式在哪裡、怎麼開,免費版與付費版差在哪

官方把這個功能叫 ChatGPT Voice(中文介面顯示為語音),在設定 → Voice(語音)裡可能看到三個選項。Live 是最新的語音體驗,付費方案用 GPT-Live-1、免費版用 GPT-Live-1 mini,特點是能同時聽和講,還能用網頁搜尋與記憶,講到一半也可以打字或加照片;Advanced(進階)是前一代的即時語音,要開鏡頭或分享螢幕時才需要切回去;Standard(標準)是一句一句輪流講的舊模式,會先把你的話轉成文字再回答。你看得到哪些選項取決於方案、地區與 App 版本。2026 年 9 月 9 日起,Live 遇到需要搜尋或推理的難題時,會在背景交給 GPT-5.6 或 GPT-6 Astra 處理,模型用跟文字對話一樣的選單挑。

  1. 手機 App(iOS 與 Android):打開 ChatGPT,按輸入框右側的語音圖示(聲波形狀,不是麥克風),第一次會要求麥克風權限並請你挑一個聲音,之後畫面一打開就可以直接講話。對話中按麥克風控制鍵可以靜音,按離開鍵結束對話。
  2. 網頁版:到 chatgpt.com,按輸入框右側的語音圖示,瀏覽器第一次會詢問麥克風權限,允許後開始講話;靜音與結束的按鍵跟 App 相同。
  3. 常用的兩個設定都在設定 → Voice:Language(語言)選你最常講的語言,辨識會準一些;Start with Voice 打開後,每次開新對話會直接進入語音,適合幫長輩或開車前設定好。想一邊用其他 App 一邊講,打開同一頁的 Background conversations(背景對話)。

額度依方案不同。OpenAI 在 2026 年 9 月 9 日簡化了 GPT-Live 的每日上限:Go 每天最多 3 小時,用的是 GPT-Live-1 mini;Plus 每天最多 3 小時 GPT-Live-1;Pro(每月 100 美元)每天最多 15 小時;Pro(每月 200 美元)不限時。免費版可以用 GPT-Live-1 mini,每 24 小時有額度上限,官方只寫「有限」沒有給數字,以官網為準。額度以連續 24 小時滾動計算,不是每天午夜歸零;單次語音對話最長 2 小時,到了上限或對話太長時它會自己結束,你可以改用文字繼續或再開一次。

支援哪些語言、能不能中英夾雜、能不能開鏡頭

官方沒有公布 Live 支援的語言清單,只說明 GPT-Live 針對 ChatGPT 最多人用的語言做過最佳化,部分語言可能有非母語口音或不流利的地方,正在持續改善;中文與英文都在常用語言之列,實際表現以你帳號的版本為準。在設定 → Voice → Language 選好主要語言後,對話中隨時可以用講的要求它換語言,例如「接下來用英文回答」;中英夾雜的句子也可以直接講,聽不懂時它會反問。另一個線索是 2026 年 6 月 26 日的發布記錄:聽寫功能換了新的語音辨識模型,官方說在使用者混用或切換語言時準確度提升,中文、日文、韓文都列在進步幅度明顯的語言裡。

鏡頭與螢幕分享要分清楚。Live 目前不支援開鏡頭讓它看東西,也不支援分享螢幕,官方說正在加入;要用這兩個功能,得在設定 → Voice 切到 Advanced,而且只有 iOS 與 Android App 上符合資格的付費訂閱者能用:語音對話中按相機鍵開始分享畫面,再按一次停止;分享螢幕則從更多選項選 Share Screen。Live 能做的是在語音對話中按輸入框的加號附上一張照片,或直接打字,它會用語音接著回答,對看菜單、看路牌這類需求已經夠用。

不管哪一種情境,語音模式的流程都一樣:第 1 步開啟語音,第 2 步用一句話設定語言與角色,第 3 步對話,第 4 步結束後回到對話裡看逐字稿。逐字稿是官方在語音結束後自動加進對話的,Live 講話時文字也會同步出現;官方提醒它不是逐字記錄,講話重疊或背景吵時可能對不上。下面這張圖把三種情境在第 2 步分別該講什麼畫在一起。

ChatGPT 語音模式四步流程圖:開啟語音、設定語言與角色、對話、看逐字稿,第 2 步分成練英文、旅行口譯、免手打三條分支,各附開場句與注意事項。
由左到右四步,中間的第 2 步依你的目的挑一條分支:開場句講清楚,後面整段對話它都會照規則走。 · 圖片:Mokaair (© Mokaair)
閱讀完整文字說明

上排四個步驟由左到右用箭頭串起。步驟 1 開啟語音:按輸入框右側的語音圖示,手機 App 與 chatgpt.com 都有,第一次要允許麥克風並挑一個聲音。步驟 2 設定語言與角色:用第一句話把規則講清楚,主要語言在設定、Voice、Language 選,三種情境的開場句見下方分支。步驟 3 對話:Live 能同時聽與講,可以打斷它,建議戴耳機、一次講一句,講到一半也能打字或加照片。步驟 4 看逐字稿:結束後自動加進對話,不是逐字記錄,吵雜時會漏字,語音片段保留 30 天。步驟 2 往下分成三條分支。練英文口說:開場句是請只用英文回答、講慢一點,我講錯時先糾正我再繼續聊;三種練法是自由聊天、角色扮演點餐訂房、請它糾正並重複一次讓你跟讀;結束後看逐字稿抄下被糾正的句子;糾正發音與文法可以,考試評分不行。旅行口譯:開場句是請當中文和日文的雙向口譯,我講中文翻成日文,對方講日文翻成中文,只翻譯不加意見;做法是一次一句、輪流講、不講時按靜音;限制是噪音大會誤判、全程要網路;對方的聲音也會保存,先徵得同意,證件與卡號不要用講的。免手打:麥克風圖示是聽寫,講完轉成文字可修改再送出,回覆是文字;聲波圖示是語音模式,你講它也講;長內容、要修改、要精確文字用聽寫;討論、邊做事邊問、練口說、口譯用語音;密碼、身分證字號、卡號兩種都不要講。最下方三行補充:額度是 Go 每天最多 3 小時 GPT-Live-1 mini、Plus 3 小時 GPT-Live-1、Pro 15 小時或不限時,免費版用 GPT-Live-1 mini,數字以官網為準;單次語音對話最長 2 小時,語音片段與逐字稿一起保留 30 天,關訓練在 Settings、Data Controls,不想留紀錄先開暫時對話;鏡頭與螢幕分享只有 Advanced 模式的付費訂閱者能用,Live 暫不支援,功能與額度常改,以官網為準。2026 年 9 月查證。

練英文口說:三種練法與可以照唸的開場句

練口說最有價值的一句話是在開頭把規則講清楚,之後整段對話它都會照做。用中文講也可以,建議照唸:「接下來請只用英文回答,講慢一點。我講錯的時候,先用一句話糾正我,再繼續聊。」Live 會等你想好再回應,講到一半停下來想單字也不太會被打斷;如果它還是搶話,可以在開頭多加一句「Wait until I ask you to respond」,這是官方給的用法。

  • 自由聊天:先挑一個你有話講的題目,例如週末做了什麼、最近看的電影。開場句:「Let's chat in English about my weekend. Ask me one question at a time, and keep your questions short.」一次一個問題你才有講的空間;講完一輪再說「Summarize three mistakes I made」,把三個錯誤記進筆記。
  • 角色扮演點餐與訂房:讓它扮演對方、你扮演自己,情境越具體越好。開場句:「You are a waiter at a café in Sydney. I am a customer. Let's practice ordering in English, and give me a hint if I get stuck.」訂房版本把角色換成飯店櫃台:「You are a hotel receptionist. I want to check in and ask about breakfast time and late checkout.」演完一輪請它加一個突發狀況,例如餐點賣完了或房間還沒整理好。
  • 請它糾正並重複一次:適合練發音與句型。開場句:「I will say one sentence at a time. First point out any pronunciation or grammar mistake, then say the correct sentence once, and wait for me to repeat it.」它會唸出正確版本讓你跟讀;想確認單字怎麼唸,文字對話裡也可以直接問,2026 年 8 月 31 日起 ChatGPT 會附上音標拆解並可以點來聽。

三種練法都建議戴耳機,官方的建議也是耳機、安靜的環境與調高音量能減少它誤判你講完或被自己的聲音干擾;iPhone 可以在語音對話中打開控制中心,把麥克風模式切成語音隔離。每次練完回到對話看逐字稿,把它糾正過的句子抄下來,隔天用同一段開場句再練一次,進步最快。它糾正得到的是發音與文法,給不了考試分數,這點看文末的提醒。

旅行口譯:中日、中英雙向翻譯怎麼叫,現場有什麼限制

GPT-Live 的官方公告說它能做即時翻譯,做法是開語音後用一句話指定規則:「接下來請當中文和日文的雙向口譯。我講中文,你翻成日文唸出來;對方講日文,你翻成中文唸出來。只翻譯,不要加自己的意見,也不要替我回答問題。」中英版本把日文換成英文即可。講完設定句先自己講一句試試,確認它翻得出來再把手機遞給對方。每一句話講短一點、講完就停,翻譯會準很多;名字、地址、金額請對方寫下來或你自己打字,不要只靠語音。

  • 噪音:Live 針對一對一對話設計,官方明說還沒針對多人同時講話最佳化,在餐廳或車站可能把旁人的交談當成在跟它講話。把手機靠近正在講話的人,兩個人輪流講,不講的時候按靜音鍵。
  • 網路:語音全程需要網路,訊號差時反應會慢或直接中斷,中斷後回到對話再按一次語音圖示就能接著用。出國前把上網方案準備好,並先在飯店測一次;單次語音對話最長 2 小時,額度用完就只能打字。
  • 隱私:對方的聲音會跟你的一起送到 OpenAI 的伺服器,語音片段會與逐字稿一起保存 30 天,所以請先徵得對方同意,護照號碼、信用卡號這類資料不要靠口譯講出來。醫療、法律、報案這類場合請找專業口譯,不要只靠它。

出國前的上網、簽證與機場攻略

免手打:聽寫與語音模式的差別,什麼時候用哪個

ChatGPT 有兩種「用講的」,圖示都在輸入框右側:麥克風圖示是聽寫(Dictation),按下去講一段話,它把錄音送去轉成文字放進輸入框,你可以先修改再送出,回覆是文字;聲波圖示才是語音模式,你講它也講,整段是即時對話。聽寫的辨識模型在 2026 年 6 月 26 日更新後,官方說在吵雜的公共場所、小聲講話、夾雜字母與數字時更穩,主要語言的字詞錯誤率至少降低 10%;Android 版從 2026 年 8 月 14 日起,加了文字或附件之後聽寫鍵仍然可以按,同一則訊息可以講一段、打幾個字、再講一段。

  • 用聽寫:要寫一段比較長、需要修改再送出的內容,例如把一件事講清楚請它整理成訊息或筆記;想留下精確的文字;在圖書館、辦公室這種不方便聽它講話的地方。
  • 用語音模式:想來回討論、邊做事邊問、練口說、當口譯;手上在忙不方便看螢幕,例如煮飯或走路的時候。
  • 兩種都不適合:講身分證字號、密碼、信用卡號。這些用打字也不該給它。
2026 年 9 月依 OpenAI help center 與發布記錄整理;開場句用中文講也可以,重點是把規則一次講清楚。
情境開場句(可以照唸)要先做的設定注意
練英文口說「接下來請只用英文回答,講慢一點。我講錯的時候,先用一句話糾正我,再繼續聊。」戴耳機;設定 → Voice → Language 選中文或英文;想固定練就開 Start with Voice結束後看逐字稿抄下被糾正的句子;它給不了考試分數
旅行口譯「請當中文和日文的雙向口譯。我講中文你翻成日文唸出來,對方講日文你翻成中文唸出來,只翻譯不要加意見。」先在飯店測一次;出國上網方案;想不留紀錄就先開暫時對話一次一句、輪流講、不講時按靜音;先徵得對方同意;證件與卡號不要用講的
免手打聽寫:按麥克風圖示講完再修改文字。語音模式:「幫我把接下來講的內容整理成一則訊息,講完我會說結束。」聽寫不用設定;語音模式想邊用其他 App 邊講就開 Background conversations要精確文字用聽寫;密碼、身分證字號、卡號兩種都不要講

隱私:語音會不會存、能不能關

會存,但用途可以控制。官方說明 Live 與 Advanced 的語音片段會和逐字稿一起保存在對話紀錄裡,保留 30 天;你刪掉那則對話,相關的語音與影片片段也會在 30 天內刪除,但封存不算刪除。Standard 模式的錄音在轉成文字後就刪掉;聽寫的錄音則只要那則對話還在紀錄裡就會保留。訓練方面,OpenAI 說明除非你自己打開「Include your audio recordings」這個開關,否則不會用你的語音片段訓練模型;但「Improve the model for everyone」開著時,語音對話的逐字稿與檔案可能會被拿去訓練。

  1. 關掉訓練:網頁版按個人頭像 → Settings → Data Controls,關掉 Improve the model for everyone;手機 App 打開側欄 → 個人頭像 → Data Controls 做同一件事。設定跟著帳號走,一個裝置關了全部生效。
  2. 不想留紀錄:先開暫時對話(Temporary Chat)再按語音圖示。官方說明暫時對話不會用來訓練模型、不會存進紀錄也不會產生記憶,系統保留最多 30 天後刪除。口譯時對方的聲音特別適合用這個方式。
  3. 已經講過的:到對話紀錄刪掉那則對話,語音片段會跟著在 30 天內刪除;刪除無法復原,封存只是從側欄移走。

做不到的是「用語音但不把聲音送出去」:語音辨識在 OpenAI 的伺服器上進行,聲音一定會傳過去。能做的就是上面三件事,加上不講不該講的內容。其他 AI 工具的同類設定可以對照下面這篇一次關好。

  • 生活分享

    通義千問 Qwen:開放權重模型家族與 Qwen Studio

    阿里巴巴的通義千問 Qwen 一邊把權重放上 Hugging Face 讓人下載,一邊經營叫 Qwen Studio(原 Qwen Chat)的網頁與 App。這篇用 2026 年 9 月查證的官方頁面,說清楚家族成員、模型卡上的參數規模與上下文視窗、Apache 2.0 與兩份 Qwen 授權差在哪、台灣能不能註冊,以及國際站 Qwen Cloud 與中國站阿里雲百煉的 API 價格。

  • 生活分享

    Mistral Vibe(原 Le Chat):歐洲 AI 助手的方案、功能與資料存放

    法國 Mistral AI 的 Le Chat 已改名為 Vibe,分成 Work、Code、Chat 三種模式。這篇整理官網當天的內容:台灣怎麼註冊與下載、Free 與每月 14.99 美元的 Pro 等四個方案給什麼、官方列出的功能、Mistral Large 3 等模型與 Apache 2.0 開放權重、API 每百萬 token 價格,以及資料預設存在歐盟、訓練開關怎麼關。

  • 生活分享

    MiniMax M 系列模型:開放權重、授權條款與 API 價格

    M 系列是 MiniMax 的文字模型線,從 M1 一路做到 M3。這篇照 2026 年 9 月 14 日官網、API 文件與 Hugging Face 官方組織頁的內容,整理現有版本與時序、參數與上下文視窗、每一代授權能不能商用、API 每百萬 token 的價格與訂閱方案、本機執行的硬體需求,並說明開放權重和開源的差別,以及 M 系列和海螺影片、語音、音樂模型的分工。

  • 生活分享

    MiniMax Agent 怎麼用:一句話做出網頁、報告與簡報

    MiniMax Agent 是 MiniMax 的代理產品,你寫一句話,它自己規劃、上網查、寫檔案,最後交出網頁、報告或簡報。這篇照 2026 年 9 月 14 日的官網頁面,說明網頁版與桌面版的入口、台灣帳號怎麼註冊、一次任務從描述到修改的流程、它會動用哪些工具、產出能匯出成哪些格式、免費額度與付費方案的月費,以及服務條款與隱私政策對上傳內容、內容審核和帳號刪除實際寫了什麼。

最新旅遊情報攻略

資料來源

生活分享