生活分享

GPT-Live 讓 ChatGPT 語音邊聽邊說:插話、方案用量與錄音設定

OpenAI 在 2026 年 7 月發布 GPT-Live,讓 ChatGPT 語音能同時聽與說、可以被插話,搜尋與推理則交給背景模型。本文依官方說明整理對話節奏的改變、9 月調整後各方案的模型與用量、做菜與練口說等使用情境、錄音保存與訓練設定,並簡短帶過 API 價格。

更新日期: 閱讀時間約 8 分鐘

手機上的語音波形與對話泡泡交錯,呈現邊聽邊說的原創插圖
圖片:Mokaair (© Mokaair)

OpenAI 在 2026 年 7 月 8 日發布新一代語音模型 GPT-Live,官方部落格與 ChatGPT 版本說明都標示這一天。GPT-Live 採用全雙工架構,能同時聆聽與說話,現在用在 ChatGPT 語音;遇到需要網路搜尋、較深入推理或較複雜工作的問題,它會在背景委派給另一個前沿模型,推出初期是 GPT-5.5,等結果準備好再帶回對話。OpenAI 同時推出 GPT-Live-1 與 GPT-Live-1 mini 兩個版本。

本文於 2026 年 9 月 15 日查核 OpenAI 發布文、說明中心的 ChatGPT 語音頁與版本說明。發布文寫的是向全球 iOS、Android 與 ChatGPT.com 使用者逐步推出,版本說明則寫在支援的地區推出、發布時不含 Business、Enterprise 與 Edu 工作區,但兩者都沒有列出地區清單,也未另外提到台灣。本站沒有實際試用,能力描述都是 OpenAI 的說法;你的台灣帳號是否已出現這個選項,請以 App 內設定為準。文中的做菜、練口說與車上情境,是編輯設計的例子。

邊聽邊說之後,對話節奏有什麼不同

OpenAI 說明,最初的 ChatGPT 語音把、語言模型與文字轉語音三個模型串在一起,回應慢且生硬;後來的進階語音模式改在單一模型內處理音訊,但仍要等使用者說完才回應,而且以靜音判斷回合,短暫停頓或背景噪音都可能被當成說完了。

GPT-Live 則在產生語音的同時持續聽,OpenAI 表示模型每秒可多次決定要說話、繼續聽、暫停、插話或呼叫工具。對話時,你可以在它回答到一半時插話提問、停下來整理思緒,或請它放慢;它可能用「嗯嗯」「了解」表示有跟上,你要求它安靜聽時也應照做。

說明中心同時提醒,語音重疊、背景噪音、網路狀況與麥克風設定都可能影響它聽到的內容,長時間停頓或旁人說話仍可能讓它開口。官方建議可改用耳機、換到較安靜的地方,iPhone 使用者可在控制中心的麥克風模式開啟語音隔離;想邊想邊說時,可以在開頭先講「等我請你回應再回應」。Live 主要為一對一對話設計,尚未針對多人同時說話最佳化。

查資料時的等待也和以前不同。OpenAI 表示,搜尋或推理交給背景模型處理時,GPT-Live 仍能繼續跟你交談,結果好了才帶回對話。編輯建議別把等待時的暫時回應當成結論,結果回來後再請它說明依據。

各方案用哪個模型、每天能用多久

發布當天,OpenAI 表示 GPT-Live-1 是 Go、Plus 與 Pro 使用者的預設模型,免費版則預設 GPT-Live-1 mini;當時語音還能另外選擇快速回覆或多花時間思考的推理程度。Go 的模型與這組推理程度,都在 2026 年 9 月 9 日的版本說明中調整,讀過早期報導的人要以現況為準。

依 9 月 9 日版本說明與說明中心,Go 改為最多 3 小時的 GPT-Live-1 mini,取代原本的 GPT-Live-1;Plus 最多 3 小時 GPT-Live-1,每月 100 美元的 Pro 最多 15 小時,每月 200 美元的 Pro 不限時數。Plus 與 Pro 達到上限後不再切換到 mini。用量以滾動 24 小時計算,免費版為有限度使用,上限可能調整。

9 月 9 日版本說明也寫到,語音需要搜尋或思考較難的問題時,可以使用 GPT-5.6 或 GPT-6 Astra,模型與推理強度改用和文字聊天相同的控制選擇,可用模型與用量依方案而定;原本語音專用的三種推理程度已取消。說明中心現在也寫,符合資格的 Business、Enterprise、Edu 與 Healthcare 工作區可使用語音,但受工作區設定約束。

2026 年 9 月 15 日查核;依 OpenAI 說明中心與 9 月 9 日版本說明,用量以滾動 24 小時計算,未列工作區方案。
方案Live 模型用量上限
免費版GPT-Live-1 mini有限度,可能調整
GoGPT-Live-1 mini3 小時
PlusGPT-Live-13 小時
Pro(每月 100 美元)GPT-Live-115 小時
Pro(每月 200 美元)GPT-Live-1不限

做菜、練口說與 CarPlay:三個使用情境

第一個情境是邊做菜邊問。手上沾著麵粉時,可以直接問某樣材料能不能替代,聽到一半發現家裡只剩兩顆蛋,就插話更正條件,不必等它講完。不過烹調溫度、過敏原與保存方式,仍應回到食譜或食品包裝核對,別只靠聽到的一句話。

第二個情境是練習口說。OpenAI 在發布文提到,每週有超過 1.5 億人透過語音與聽寫等功能和 ChatGPT 對話,用途包括練習語言。你可以在設定 → 語音選擇最常說的語言,也能在對話中要求它換語言或說慢一點,但說明中心寫目前無法精確控制播放速度。OpenAI 表示已針對部分最常用的語言最佳化,但未列出清單,部分語言可能帶非母語口音或不夠流暢,練發音時別把它的口音當標準。

第三個情境是車上。說明中心寫 ChatGPT 可在支援的 iPhone 上透過 Apple CarPlay 使用,同時提醒只在法律允許且情況安全時使用行動裝置,應在駕駛前設定好 App,避免在車輛行進中操作。編輯建議行車中不要看螢幕上的文字回應;營業時間、地址這類資訊,停車後再用官方來源確認。

如果想在切到其他 App 或手機鎖定時繼續對話,需要到設定 → 語音開啟背景對話;2026 年 8 月 31 日的版本說明也提到,iPhone 的鎖定畫面與動態島可以顯示 Live 語音對話的內容。背景對話會在你結束對話、強制關閉 App、達到用量上限或最長工作階段長度時結束。

GPT-Live 語音對話四個重點的圖解:同時聽與說、背景查資料、方案與用量、錄音與核對
GPT-Live 語音的四個重點:同時聽與說、背景查資料、各方案模型與用量、錄音保存與回答核對;依 OpenAI 官方說明整理。 · 圖片:Mokaair (© Mokaair)

錄音、逐字稿與訓練:先看官方資料控制說明

說明中心寫,Live 與進階語音對話的音訊片段,會和對話記錄中的逐字稿一起儲存,保留 30 天。刪除對話後,相關音訊片段會在 30 天內刪除,但基於安全、保障或法律原因需要保留,或你先前已選擇分享且片段已與帳戶解除關聯的情況除外。刪除無法復原,封存只是從側邊欄移除,不會刪掉音訊。

錄音會不會拿去訓練模型,要看兩個開關。說明中心表示,除非你選擇分享,否則不會用音訊片段訓練;個人工作區的免費版、Plus 與 Pro 使用者,要先在設定 → 資料控制項開啟「為所有人改進模型」,再開啟「包含你的錄音」才會分享;Business、Enterprise 與 Edu 工作區則無法分享片段。另要注意,只要「為所有人改進模型」開著,語音對話的逐字稿與其他檔案就可能依方案與設定被用於訓練。

分享的片段可能由 OpenAI 團隊審查;停止分享後,先前已解除關聯的片段仍可能繼續使用。OpenAI 另在 2026 年 7 月 31 日更新發布文,表示 GPT-Live 生成的受支援音訊已加入 SynthID 浮水印;家長也可透過家長控制決定青少年子女能否使用語音。

語音回答仍要核對,API 價格簡單帶過

說出來的回答聽過就過去,比文字更難回頭檢查。說明中心提醒 ChatGPT 可能出錯,日期、時間或地點相關的問題尤其要核對;語音會用裝置或瀏覽器的時區理解「今天」「明天」,回答不對時可以直接說出確切日期與地點。使用 Live 時回答會同步以文字顯示,結束後可在對話記錄查看,但逐字稿不是逐字紀錄,可能與實際說的內容不完全相符。

Live 目前也有功能邊界。說明中心寫它不支援視訊、螢幕分享、已連結的應用程式或外掛程式,需要視訊或螢幕分享時,符合資格的訂閱者可在 iOS 與 Android App 改用進階模式;一次只能進行一個語音對話,達到用量上限、最長工作階段長度或長對話的內容脈絡限制時,對話也可能結束。

開發者端和 ChatGPT 裡的推出是兩件事:OpenAI 的 API 更新紀錄在 2026 年 9 月 10 日寫到,GPT-Live 1 在 API 正式開放,語音工作階段每分鐘 0.05 美元、按秒計費,背後搭配的模型與工具用量另外計費。

最新旅遊情報攻略

資料來源

生活分享