生活分享

Gemini 3.8 Live 與 Extended Thinking:新語音模型,你的帳號能用嗎?

2026 年 9 月 15 日,Google 發表 Gemini 3.8 Live 與 Gemini 3.8 Live Extended Thinking 兩款語音對話模型。本文依 Google 官方發表文、開發者文、模型卡與定價頁,整理開發者、企業、一般使用者與 Workspace 訂閱者各自能用到什麼、費用怎麼計算,以及模型卡寫的知識截止日與官方未說明的開放地區。

閱讀時間約 11 分鐘

原創插圖:左邊一個圓角對話框裡畫著一排聲波線,代表語音對話;一支箭頭指向右邊四個方框,代表四種使用身分,其中兩個是實線、兩個是虛線外框,象徵同時發表但開放程度不同。
圖片:Mokaair (© Mokaair)

2026 年 9 月 15 日,Google 以模型發表文與開發者文兩篇公告,發表兩款語音對話模型:Gemini 3.8 Live 與 Gemini 3.8 Live Extended Thinking。Google 為兩款模型定了不同位置:3.8 Live「為規模與成本效率打造,結合對話智慧、流暢對答與視覺參照」;Extended Thinking「為高複雜度任務打造,具備更高智慧與多步驟推理能力」。

本文於 2026 年 9 月 18 日查核 Google 的模型發表文、開發者文、DeepMind 模型卡與 Gemini API 定價頁,內容以查核當天為準。本站沒有實際使用這兩款模型,文中能力、排行榜名次與價格都是 Google 的說法,以「Google 表示」標示廠商宣稱;本文也不構成使用或購買建議。

這次發表了什麼:兩個模型,兩種定位

模型發表文把 Gemini 3.8 Live 的幾項能力寫在同一段文字:能近乎即時處理視覺輸入,讓對話有畫面可以參照;能自動偵測並切換語言,發表文寫的是支援 97 種語言;也能在背景執行工具與 API 呼叫、同時繼續對話,讓使用者先聽到回覆、工作再於背景完成。

Extended Thinking 的差異在於推理方式:Google 說明這款模型會「一邊推理一邊說話」,遇到需要深度推理的任務時,先用「讓我確認一下」之類的話語自然承接,再用進度旁白帶使用者走過多步驟的背景工作;開發者文把兩款模型合稱為「比串接式架構更精簡的替代方案」。

開發者文另外條列主要能力,用的是「包括」:非同步函式呼叫、視覺情境、字母數字精確度(準確判讀確認碼、理賠編號與技術資料)、多語言支援(「97 種以上」語言並保持腔調一致),以及漸進式內容更新。發表文說 Google AI 產品生成的語音都會加上 SynthID 浮水印,讓 AI 生成內容維持可被偵測。

四種身分,各自能用到哪一個模型

開發者這一側寫得最明確:Google 對兩款模型都寫「即日起開始推出」,通路是 Gemini API 與 AI Studio。企業端則只在 Gemini Enterprise 開放私人預覽;Customer Experience 場景與(僅 Extended Thinking)Workspace 企業用戶端都還寫著「即將推出」,沒有時間表。

發表文那張清單上,消費端分工是:3.8 Live 對「所有人」只寫了 Search Live;Extended Thinking 寫 Gemini Live,加上 Workspace 的「文件」限 Google AI Pro 與 Ultra 訂閱者,「Gmail」與「Keep」則開放給所有 Google AI 訂閱者——「文件」的訂閱門檻比「Gmail」與「Keep」高。同一篇發表文的影片圖說另外寫 Extended Thinking 在 Gemini App 裡,內文與小節標題也把兩款模型合稱寫進 Gemini App。

模型卡的通路清單不同:兩款模型一致列出 Gemini API、Gemini App、AI Studio、Vertex AI,3.8 Live 另加 Search Live,Extended Thinking 另加 Gmail、文件與 Keep 所在的 Workspace。發表文那張清單沒有 Vertex AI,也沒把 Gemini App 算給 3.8 Live;本文兩份照原樣並列,不替 Google 認定哪一份才準。發表文頂端另標示曾於 9 月 17 日更新。

依 Google 2026 年 9 月 15 日發表文與模型卡整理,查核日 2026 年 9 月 18 日;模型卡另列 Gemini App 與 Vertex AI 為兩款模型共同通路,詳見前文說明。
身分可用模型開放內容狀態
開發者兩款皆可Gemini API、AI Studio即日起推出
企業兩款皆可Gemini Enterprise私人預覽
一般使用者3.8 LiveSearch Live即日起推出
一般使用者Extended ThinkingGemini Live、Gemini App即日起推出
Workspace 訂閱者Extended Thinking文件限 AI Pro/Ultra;Gmail、Keep 限 Google AI 訂閱者即日起推出

「即日起推出」不等於「現在就能用」

Google 原文寫「rolling out starting today」,是開始不是完成;企業端明講是私人預覽,標著「即將推出」的場景也沒有時間表。查核到 2026 年 9 月 18 日,三份文件說明可用性時只點名產品與訂閱身分,沒有一句寫出開放的國家、地區或市場,本文因此無法判斷台灣帳號是否已在可用範圍。

企業私人預覽同樣沒有寫申請管道或資格條件,Google 也沒有講推出什麼時候算完成,使用者無從判斷何時會拿到。

語言數字兩篇寫法不同:模型發表文寫 3.8 Live 會在對話中自動切換「97 種支援語言」,開發者文的能力條列寫「97 種以上」。兩個數字都是 Google 自己給的,本文照原樣並列,不合併成一個。

四格圖解:開發者、企業、消費端與 Workspace 四種身分各自的開放狀態,不含商標或介面畫面
依 Google 2026 年 9 月 15 日發表整理:開發者、企業、消費端與 Workspace 四種身分的開放狀態,查核日 2026 年 9 月 18 日。 · 圖片:Mokaair (© Mokaair)

費用與資料:兩款模型共用一張價目表

Gemini API 定價頁把 gemini-3.8-live、gemini-3.8-live-extended-thinking 與較早的 gemini-3.1-flash-live-preview 列在同一個價格區塊、共用同一組價格,也沒有寫新模型取代或停用它。發表文說 3.8 Live「為規模與成本效率打造」,那是定位說法,不是牌價比較低。

定價頁的付費層級:輸入每百萬 token 文字 0.75 美元、語音 3 美元(每分鐘 0.005 美元)、圖像影片 1 美元;輸出每百萬 token(含思考 token)文字 4.5 美元、語音 12 美元(每分鐘 0.018 美元)。開發者文引用每分鐘數字時加了註腳,說明那是用每百萬 token 價格換算的估計值。

定價頁還有免費層級:輸入輸出都寫「免費」,資料會用於改善產品,付費層級則不會。Google 搜尋即時查證(grounding)的額度列在付費層級:每月 5,000 次免費搜尋由 Gemini 3.x 系列共用,超過後每 1,000 次收費 14 美元;一次請求可能觸發不只一次查詢,每次都算費用。

模型卡另外寫了規格:兩款模型都以 Gemini 3 Pro 為基礎,輸入涵蓋音訊、圖像、影片與文字,情境窗上限 128K token;輸出音訊與文字,64K token。知識截止日是 2025 年 1 月,代表模型記得的事到那時候為止,時效性內容仍要靠另外計費的搜尋 grounding 補。

Google 沒有講的部分,以及一個編輯設計的情境

評測數字都出自 Google 發表文:Extended Thinking 在 Artificial Analysis 的 Speech to Speech Quality Index「整體第一(82.6)」,τ-Voice 68.6%、Sierra 的 τ-Voice-banking 基準 35.1%、Big Bench Audio 97.7%;3.8 Live 則在 Speech Agent Arena「第二名」。這些是 9 月 15 日的快照,本站未自行測試,排行榜會持續變動。

安全性方面,模型卡寫 Google 依前沿安全框架評估的對象是 Gemini 3.7 Flash,結果沒有觸及任何「已追蹤或關鍵能力等級」;因兩款新模型相較 3.7 Flash 沒有明顯新能力或效能實質提升,Google 表示它們「不太可能」觸及那些等級——這是從另一款模型的結果推論,不是針對這兩款模型的評估。模型卡也寫明可能出現幻覺與偶爾的遲緩或逾時,並仍在改善誘導攻擊的抵抗力。

以下是編輯設計的情境,不是實測結果。假設使用者對著行程比較表,用語音請 Extended Thinking 整理重點:依 Google 的說法,模型會先回應、把整理放到背景執行,再用進度旁白交代進度。這疊了三個還沒確定的條件:帳號要在合格地區、要用對的介面與訂閱身分;加上 2025 年 1 月的知識截止日,日期相關的細節仍要靠另外計費的搜尋 grounding。

常見問題

台灣的 Google 帳號現在可以用 Gemini 3.8 Live 或 Extended Thinking 嗎?

以本文查核到 2026 年 9 月 18 日為止,Google 的發表文、開發者文與模型卡在說明可用性時只點名產品與訂閱身分,沒有一句寫出開放的國家、地區或市場,官方未說明開放地區。文中能查到的只有身分別(開發者、企業、一般使用者、Workspace 訂閱者)與介面別的差異,沒有地區別的說明,本文無法代替 Google 確認台灣帳號是否已經可以使用。

Gemini 3.8 Live 跟 Gemini 3.8 Live Extended Thinking 差在哪裡?

Google 把 Gemini 3.8 Live 定位成為規模與成本效率打造,發表文那張可用性清單給一般使用者的通路只寫了 Search Live;Extended Thinking 定位成處理高複雜度、多步驟推理的任務,一般使用者在 Gemini Live,以及 Workspace 的文件(限 Google AI Pro 與 Ultra 訂閱者)、Gmail 與 Keep(開放給所有 Google AI 訂閱者)用得到。兩款模型在 Gemini API 上共用同一張價目表,定價頁把輸出價格註明為含思考 token。

Gemini App 裡面能不能用到這兩款新模型?

發表文那張可用性清單上,3.8 Live 對「所有人」只寫了 Search Live,Extended Thinking 寫的是 Gemini Live 與 Workspace;不過同一篇發表文的影片圖說也寫著 Extended Thinking 在 Gemini App 裡,內文與小節標題也把兩款模型合稱寫進去,沒有分開點名是哪一款。DeepMind 的模型卡則把 Gemini App 與 Google Cloud/Vertex AI 都列成兩款模型共同的通路,而發表文那張清單沒有 Vertex AI,也沒把 Gemini App 算給 3.8 Live。兩份清單的列法不同,本文把幾種寫法照原樣列出,本站無法代為判斷哪一份才是最新或最準確的狀態。

用語音會比用文字貴嗎?

以 Gemini API 定價頁的數字,語音輸入每百萬 token 3 美元、文字輸入每百萬 token 0.75 美元,語音的單位定價確實比較高;定價頁與開發者文都印了「每分鐘 0.005 美元」與「每分鐘 0.018 美元」,開發者文的註腳說明那是用每百萬 token 價格換算的估計值,定價表本身也是以每百萬 token 標價。另外還有一個免費層級,輸入與輸出都不收費,但資料會用於改善 Google 的產品。

這兩款模型知道最新發生的事嗎?

模型卡寫的知識截止日是 2025 年 1 月,也就是模型本身記得的內容到那時候為止,並不會因為主打即時對話就自動知道之後發生的事。如果需要查證時效性的內容,要靠 Google 搜尋的 grounding 功能;定價頁在付費層級那一欄列出每月 5,000 次免費額度、用量由所有 Gemini 3.x 系列模型共用,超過後每 1,000 次收費 14 美元,免費層級那一欄只寫「支援」,沒有列出額度或價格。

97 種語言是哪 97 種?

本文查核的四份文件都沒有列出語言名稱。模型發表文寫 Gemini 3.8 Live 會在對話中自動切換「97 種支援語言」,開發者文的能力條列寫「97 種以上」;兩個數字都是 Google 自己給的,本文照原樣並列,不合併成一個。另外要提醒:這個數字說的是模型在對話中聽得懂、說得出的語言,Google 沒有在這四份文件裡說明各個介面本身的介面語言或開放地區。

  • 生活分享

    GPT-Live 1 開放 API:電話客服能不能接、聲音是誰的、會不會錄音

    2026 年 9 月 10 日,OpenAI 的 API 更新紀錄寫下全雙工語音模型 GPT-Live 1 已在 API 正式提供,開發者可以把它接進電話客服、App 或自己的產品。本文依 OpenAI 開發者文件整理這個模型在 API 裡的規格、電話怎麼接上以及文件說這個端點不支援外撥、內建的 12 個具名語音與沒有列出的支援語言,還有錄音與每分鐘計費方式;本站沒有實測。

  • 生活分享

    GPT-5.5 Instant 成為 ChatGPT 預設模型:官方公布的進步、退步與新功能

    2026 年 5 月 5 日,OpenAI 以 GPT-5.5 Instant 取代 GPT-5.3 Instant,成為 ChatGPT 的預設模型。本文依官方公告與系統卡,整理事實查核進步的數字、血腥與性內容兩項退步、新增個人化功能的開放對象與地區但書,以及同年 8 月 6 日官方寫明新模型將取代它的時間點,並說明官方數字為何不代表日常出錯率。

  • 生活分享

    GPT-Live 讓 ChatGPT 語音邊聽邊說:插話、方案用量與錄音設定

    OpenAI 在 2026 年 7 月發布 GPT-Live,讓 ChatGPT 語音能同時聽與說、可以被插話,搜尋與推理則交給背景模型。本文依官方說明整理對話節奏的改變、9 月調整後各方案的模型與用量、做菜與練口說等使用情境、錄音保存與訓練設定,並簡短帶過 API 價格。

  • 生活分享

    NVIDIA 推出 DGX Spark 64GB 版:10 月 23 日上市、起價 4,999 美元,兩台可串接成 128GB

    NVIDIA 於 2026 年 10 月 2 日宣布,個人 AI 電腦 DGX Spark 新增較平價的 64GB 記憶體版本,10 月 23 日起由 Acer、ASUS 等六家廠商供應,主要對象是想在自己機器上執行 AI 模型的開發者與研究人員。以下整理 NVIDIA 公布的規格、雙機串接說法,以及對一般讀者的意義。

最新旅遊情報攻略

資料來源

生活分享