生活分享
GPT-Live 讓 ChatGPT 語音邊聽邊說:插話、方案用量與錄音設定
OpenAI 在 2026 年 7 月發布 GPT-Live,讓 ChatGPT 語音能同時聽與說、可以被插話,搜尋與推理則交給背景模型。本文依官方說明整理對話節奏的改變、9 月調整後各方案的模型與用量、做菜與練口說等使用情境、錄音保存與訓練設定,並簡短帶過 API 價格。
更新日期: 閱讀時間約 8 分鐘

OpenAI 在 2026 年 7 月 8 日發布新一代語音模型 GPT-Live,官方部落格與 ChatGPT 版本說明都標示這一天。GPT-Live 採用全雙工架構,能同時聆聽與說話,現在用在 ChatGPT 語音;遇到需要網路搜尋、較深入推理或較複雜工作的問題,它會在背景委派給另一個前沿模型,推出初期是 GPT-5.5,等結果準備好再帶回對話。OpenAI 同時推出 GPT-Live-1 與 GPT-Live-1 mini 兩個版本。
本文於 2026 年 9 月 15 日查核 OpenAI 發布文、說明中心的 ChatGPT 語音頁與版本說明。發布文寫的是向全球 iOS、Android 與 ChatGPT.com 使用者逐步推出,版本說明則寫在支援的地區推出、發布時不含 Business、Enterprise 與 Edu 工作區,但兩者都沒有列出地區清單,也未另外提到台灣。本站沒有實際試用,能力描述都是 OpenAI 的說法;你的台灣帳號是否已出現這個選項,請以 App 內設定為準。文中的做菜、練口說與車上情境,是編輯設計的例子。
邊聽邊說之後,對話節奏有什麼不同
OpenAI 說明,最初的 ChatGPT 語音把語音轉文字自動語音辨識(ASR)是什麼:把錄音轉成可核對的文字自動語音辨識就是「語音轉文字 AI」背後的技術:把語音訊號轉成文字,是字幕、口述輸入與會議逐字稿的基礎。本文以社區活動籌備錄音為例,說明聲音如何經過模型形成轉寫結果、為何人名與否定詞要回聽,也拆開逐字稿、說話者標記、翻譯與摘要的差別,並介紹錯誤率的用途與限制,讓流暢文字不會被誤當成完整可靠的會議紀錄。閱讀全文、語言模型與文字轉語音三個模型串在一起,回應慢且生硬;後來的進階語音模式改在單一模型內處理音訊,但仍要等使用者說完才回應,而且以靜音判斷回合,短暫停頓或背景噪音都可能被當成說完了。
GPT-Live 則在產生語音的同時持續聽,OpenAI 表示模型每秒可多次決定要說話、繼續聽、暫停、插話或呼叫工具。對話時,你可以在它回答到一半時插話提問、停下來整理思緒,或請它放慢;它可能用「嗯嗯」「了解」表示有跟上,你要求它安靜聽時也應照做。
說明中心同時提醒,語音重疊、背景噪音、網路狀況與麥克風設定都可能影響它聽到的內容,長時間停頓或旁人說話仍可能讓它開口。官方建議可改用耳機、換到較安靜的地方,iPhone 使用者可在控制中心的麥克風模式開啟語音隔離;想邊想邊說時,可以在開頭先講「等我請你回應再回應」。Live 主要為一對一對話設計,尚未針對多人同時說話最佳化。
查資料時的等待也和以前不同。OpenAI 表示,搜尋或推理交給背景模型處理時,GPT-Live 仍能繼續跟你交談,結果好了才帶回對話。編輯建議別把等待時的暫時回應當成結論,結果回來後再請它說明依據。
各方案用哪個模型、每天能用多久
發布當天,OpenAI 表示 GPT-Live-1 是 Go、Plus 與 Pro 使用者的預設模型,免費版則預設 GPT-Live-1 mini;當時語音還能另外選擇快速回覆或多花時間思考的推理程度。Go 的模型與這組推理程度,都在 2026 年 9 月 9 日的版本說明中調整,讀過早期報導的人要以現況為準。
依 9 月 9 日版本說明與說明中心,Go 改為最多 3 小時的 GPT-Live-1 mini,取代原本的 GPT-Live-1;Plus 最多 3 小時 GPT-Live-1,每月 100 美元的 Pro 最多 15 小時,每月 200 美元的 Pro 不限時數。Plus 與 Pro 達到上限後不再切換到 mini。用量以滾動 24 小時計算,免費版為有限度使用,上限可能調整。
9 月 9 日版本說明也寫到,語音需要搜尋或思考較難的問題時,可以使用 GPT-5.6 或 GPT-6 Astra,模型與推理強度改用和文字聊天相同的控制選擇,可用模型與用量依方案而定;原本語音專用的三種推理程度已取消。說明中心現在也寫,符合資格的 Business、Enterprise、Edu 與 Healthcare 工作區可使用語音,但受工作區設定約束。
| 方案 | Live 模型 | 用量上限 |
|---|---|---|
| 免費版 | GPT-Live-1 mini | 有限度,可能調整 |
| Go | GPT-Live-1 mini | 3 小時 |
| Plus | GPT-Live-1 | 3 小時 |
| Pro(每月 100 美元) | GPT-Live-1 | 15 小時 |
| Pro(每月 200 美元) | GPT-Live-1 | 不限 |
做菜、練口說與 CarPlay:三個使用情境
第一個情境是邊做菜邊問。手上沾著麵粉時,可以直接問某樣材料能不能替代,聽到一半發現家裡只剩兩顆蛋,就插話更正條件,不必等它講完。不過烹調溫度、過敏原與保存方式,仍應回到食譜或食品包裝核對,別只靠聽到的一句話。
第二個情境是練習口說。OpenAI 在發布文提到,每週有超過 1.5 億人透過語音與聽寫等功能和 ChatGPT 對話,用途包括練習語言。你可以在設定 → 語音選擇最常說的語言,也能在對話中要求它換語言或說慢一點,但說明中心寫目前無法精確控制播放速度。OpenAI 表示已針對部分最常用的語言最佳化,但未列出清單,部分語言可能帶非母語口音或不夠流暢,練發音時別把它的口音當標準。
第三個情境是車上。說明中心寫 ChatGPT 可在支援的 iPhone 上透過 Apple CarPlay 使用,同時提醒只在法律允許且情況安全時使用行動裝置,應在駕駛前設定好 App,避免在車輛行進中操作。編輯建議行車中不要看螢幕上的文字回應;營業時間、地址這類資訊,停車後再用官方來源確認。
如果想在切到其他 App 或手機鎖定時繼續對話,需要到設定 → 語音開啟背景對話;2026 年 8 月 31 日的版本說明也提到,iPhone 的鎖定畫面與動態島可以顯示 Live 語音對話的內容。背景對話會在你結束對話、強制關閉 App、達到用量上限或最長工作階段長度時結束。
錄音、逐字稿與訓練:先看官方資料控制說明
說明中心寫,Live 與進階語音對話的音訊片段,會和對話記錄中的逐字稿一起儲存,保留 30 天。刪除對話後,相關音訊片段會在 30 天內刪除,但基於安全、保障或法律原因需要保留,或你先前已選擇分享且片段已與帳戶解除關聯的情況除外。刪除無法復原,封存只是從側邊欄移除,不會刪掉音訊。
錄音會不會拿去訓練模型,要看兩個開關。說明中心表示,除非你選擇分享,否則不會用音訊片段訓練;個人工作區的免費版、Plus 與 Pro 使用者,要先在設定 → 資料控制項開啟「為所有人改進模型」,再開啟「包含你的錄音」才會分享;Business、Enterprise 與 Edu 工作區則無法分享片段。另要注意,只要「為所有人改進模型」開著,語音對話的逐字稿與其他檔案就可能依方案與設定被用於訓練。
分享的片段可能由 OpenAI 團隊審查;停止分享後,先前已解除關聯的片段仍可能繼續使用。OpenAI 另在 2026 年 7 月 31 日更新發布文,表示 GPT-Live 生成的受支援音訊已加入 SynthID 浮水印;家長也可透過家長控制決定青少年子女能否使用語音。
語音回答仍要核對,API 價格簡單帶過
說出來的回答聽過就過去,比文字更難回頭檢查。說明中心提醒 ChatGPT 可能出錯,日期、時間或地點相關的問題尤其要核對;語音會用裝置或瀏覽器的時區理解「今天」「明天」,回答不對時可以直接說出確切日期與地點。使用 Live 時回答會同步以文字顯示,結束後可在對話記錄查看,但逐字稿不是逐字紀錄,可能與實際說的內容不完全相符。
Live 目前也有功能邊界。說明中心寫它不支援視訊、螢幕分享、已連結的應用程式或外掛程式,需要視訊或螢幕分享時,符合資格的訂閱者可在 iOS 與 Android App 改用進階模式;一次只能進行一個語音對話,達到用量上限、最長工作階段長度或長對話的內容脈絡限制時,對話也可能結束。
開發者端和 ChatGPT 裡的推出是兩件事:OpenAI 的 API 更新紀錄在 2026 年 9 月 10 日寫到,GPT-Live 1 在 API 正式開放,語音工作階段每分鐘 0.05 美元、按秒計費,背後搭配的模型與工具用量另外計費。
2026 年 AI 新聞總整理:1 月至 9 月的重點與生活應用2026 年 AI 新聞總整理:1 月至 9 月的重點與生活應用從 2026 年 1 月至 9 月,依月份整理 AI 重要新聞,連到完整解析,多數另有簡體中文、英文、日文與韓文版。涵蓋模型、工作工具、創作、費用與透明度,說明事件背景、生活用途與開放限制。閱讀全文
Gemini Live 生產力更新:用語音處理郵件與待辦Gemini Live 生產力更新:用語音處理郵件與待辦Google 在 2026 年 8 月 26 日公布 Gemini Live 生產力更新,把語音互動延伸到郵件、每日摘要與多步驟工作。這篇整理 Spark、Daily Brief 和個人化資料連結的差別,說明公告列出的方案門檻,再用家庭通知與工作筆記情境,教你設定查找範圍、確認動作和驗收成果,並提醒台灣帳號的實際開放情況需另行確認。閱讀全文
同主題延伸閱讀
生活分享
NVIDIA 推出 DGX Spark 64GB 版:10 月 23 日上市、起價 4,999 美元,兩台可串接成 128GB
NVIDIA 於 2026 年 10 月 2 日宣布,個人 AI 電腦 DGX Spark 新增較平價的 64GB 記憶體版本,10 月 23 日起由 Acer、ASUS 等六家廠商供應,主要對象是想在自己機器上執行 AI 模型的開發者與研究人員。以下整理 NVIDIA 公布的規格、雙機串接說法,以及對一般讀者的意義。
生活分享
Google Cloud 宣布 Spanner queues 正式推出:把訊息佇列放進資料庫交易,瞄準 AI 代理可靠性
Google Cloud 宣布 Spanner queues 正式推出,讓訊息建立成為資料庫交易的一部分,目標是解決 AI 代理「狀態」與「動作」不同步的問題。本文整理官方說法、主要功能與對一般讀者的意義。
生活分享
GPT-6.1 Sol 推出:新一版 Sol 上 API、Codex 與 ChatGPT Work,Chat 裡沒有
OpenAI 在 2026 年 9 月 29 日推出 GPT-6.1 Sol,API 名稱是 gpt-6.1-sol:Plus、Pro、Business、Enterprise、Edu 方案的 Codex 與 ChatGPT Work 在首發推出範圍內,Enterprise 與 Edu 要管理員啟用,Free 與 Go 首發不含,Chat 裡沒有(2026 年 9 月查證)。
生活分享
Claude Sonnet 5.5 推出:牌價與 Sonnet 5 相同,API、雲端平台與 Claude.ai 都能用
Anthropic 在 2026 年 9 月 28 日推出 Claude Sonnet 5.5,API 牌價與 Sonnet 5 相同(每百萬 tokens 輸入 2 美元、輸出 10 美元);Claude.ai、API 與多個雲端平台可用,較高風險的資安請求會退回 Sonnet 5 處理(2026 年 9 月查證)。
引用本文的文章
最新旅遊情報攻略

情報
2026 韓國楓葉預測:雪嶽山 10 月 20 日、首爾近郊 10 月底、內藏山與漢拏山 11 月上旬
韓國山林廳 2026 年 9 月 22 日公布的楓紅高峰預測:雪嶽山 10 月 20 日,春川、國立樹木園到首爾植物園落在 10 月 28 日到 11 月 2 日,內藏山 11 月 4 日、漢拏山 11 月 6 日,整體比最近 5 年晚約 0.8 天。整理各地楓樹與銀杏的預測日、首爾出發怎麼排,以及出發前去哪裡看即時楓況。2026 年 10 月查證。
- 季節活動
- 自然
- 觀景

攻略胡志明市
胡志明市到頭頓一日遊:白藤碼頭搭高速船、船票與班次,下船就是胡梅纜車與耶穌基督像
人在胡志明市挪一天去頭頓看海:市中心的白藤高速船碼頭搭船,航程 120 分鐘到頭頓的胡梅碼頭,平日成人 320,000 越南盾、週末 350,000,回程末班平日 15:00。下船就是胡梅纜車站,同一條路上有白宮,小山頂上是耶穌基督像。平日一天只有兩班船,整天要從末班船倒推著排。
- 交通
- 行程範例
- 海灘

攻略沖繩
沖繩不開車攻略:單軌只到浦添,美麗海水族館要坐兩個多小時的巴士,回那霸的最後一班直達車 17:22 就開走
不租車的沖繩怎麼移動:那霸市區靠沖繩都市單軌電車(ゆいレール),那霸機場站到終點てだこ浦西 19 站、17 公里、37 分鐘,一日券 1,000 日圓;美麗海水族館有那霸機場直達的高速巴士,單程 2,000 日圓起、官方時刻表上 2 小時上下,下車後還要走 10 分鐘;古宇利島要在今帰仁村役場轉車,當天來回光坐車就六個半小時;回程的最後一班直達車 17:22 就從記念公園前開走(2026 年 9 月查證)。
- 交通
- 行程範例
- 預算
資料來源
- OpenAI:介紹 GPT-Live · 查證日期:
- OpenAI 說明中心:ChatGPT 語音 · 查證日期:
- OpenAI 說明中心:ChatGPT Release Notes · 查證日期:
- OpenAI 開發者文件:API Changelog · 查證日期: