生活分享
Gemini 3.8 Live 與 Extended Thinking:新語音模型,你的帳號能用嗎?
2026 年 9 月 15 日,Google 發表 Gemini 3.8 Live 與 Gemini 3.8 Live Extended Thinking 兩款語音對話模型。本文依 Google 官方發表文、開發者文、模型卡與定價頁,整理開發者、企業、一般使用者與 Workspace 訂閱者各自能用到什麼、費用怎麼計算,以及模型卡寫的知識截止日與官方未說明的開放地區。
閱讀時間約 11 分鐘

2026 年 9 月 15 日,Google 以模型發表文與開發者文兩篇公告,發表兩款語音對話模型:Gemini 3.8 Live 與 Gemini 3.8 Live Extended Thinking。Google 為兩款模型定了不同位置:3.8 Live「為規模與成本效率打造,結合對話智慧、流暢對答與視覺參照」;Extended Thinking「為高複雜度任務打造,具備更高智慧與多步驟推理能力」。
本文於 2026 年 9 月 18 日查核 Google 的模型發表文、開發者文、DeepMind 模型卡與 Gemini API 定價頁,內容以查核當天為準。本站沒有實際使用這兩款模型,文中能力、排行榜名次與價格都是 Google 的說法,以「Google 表示」標示廠商宣稱;本文也不構成使用或購買建議。
這次發表了什麼:兩個模型,兩種定位
模型發表文把 Gemini 3.8 Live 的幾項能力寫在同一段文字:能近乎即時處理視覺輸入,讓對話有畫面可以參照;能自動偵測並切換語言,發表文寫的是支援 97 種語言;也能在背景執行工具與 API 呼叫、同時繼續對話,讓使用者先聽到回覆、工作再於背景完成。
Extended Thinking 的差異在於推理方式:Google 說明這款模型會「一邊推理一邊說話」,遇到需要深度推理的任務時,先用「讓我確認一下」之類的話語自然承接,再用進度旁白帶使用者走過多步驟的背景工作;開發者文把兩款模型合稱為「比串接式架構更精簡的替代方案」。
開發者文另外條列主要能力,用的是「包括」:非同步函式呼叫、視覺情境、字母數字精確度(準確判讀確認碼、理賠編號與技術資料)、多語言支援(「97 種以上」語言並保持腔調一致),以及漸進式內容更新。發表文說 Google AI 產品生成的語音都會加上 SynthID 浮水印,讓 AI 生成內容維持可被偵測。
四種身分,各自能用到哪一個模型
開發者這一側寫得最明確:Google 對兩款模型都寫「即日起開始推出」,通路是 Gemini API 與 AI Studio。企業端則只在 Gemini Enterprise 開放私人預覽;Customer Experience 場景與(僅 Extended Thinking)Workspace 企業用戶端都還寫著「即將推出」,沒有時間表。
發表文那張清單上,消費端分工是:3.8 Live 對「所有人」只寫了 Search Live;Extended Thinking 寫 Gemini Live,加上 Workspace 的「文件」限 Google AI Pro 與 Ultra 訂閱者,「Gmail」與「Keep」則開放給所有 Google AI 訂閱者——「文件」的訂閱門檻比「Gmail」與「Keep」高。同一篇發表文的影片圖說另外寫 Extended Thinking 在 Gemini App 裡,內文與小節標題也把兩款模型合稱寫進 Gemini App。
模型卡的通路清單不同:兩款模型一致列出 Gemini API、Gemini App、AI Studio、Vertex AI,3.8 Live 另加 Search Live,Extended Thinking 另加 Gmail、文件與 Keep 所在的 Workspace。發表文那張清單沒有 Vertex AI,也沒把 Gemini App 算給 3.8 Live;本文兩份照原樣並列,不替 Google 認定哪一份才準。發表文頂端另標示曾於 9 月 17 日更新。
| 身分 | 可用模型 | 開放內容 | 狀態 |
|---|---|---|---|
| 開發者 | 兩款皆可 | Gemini API、AI Studio | 即日起推出 |
| 企業 | 兩款皆可 | Gemini Enterprise | 私人預覽 |
| 一般使用者 | 3.8 Live | Search Live | 即日起推出 |
| 一般使用者 | Extended Thinking | Gemini Live、Gemini App | 即日起推出 |
| Workspace 訂閱者 | Extended Thinking | 文件限 AI Pro/Ultra;Gmail、Keep 限 Google AI 訂閱者 | 即日起推出 |
「即日起推出」不等於「現在就能用」
Google 原文寫「rolling out starting today」,是開始不是完成;企業端明講是私人預覽,標著「即將推出」的場景也沒有時間表。查核到 2026 年 9 月 18 日,三份文件說明可用性時只點名產品與訂閱身分,沒有一句寫出開放的國家、地區或市場,本文因此無法判斷台灣帳號是否已在可用範圍。
企業私人預覽同樣沒有寫申請管道或資格條件,Google 也沒有講推出什麼時候算完成,使用者無從判斷何時會拿到。
語言數字兩篇寫法不同:模型發表文寫 3.8 Live 會在對話中自動切換「97 種支援語言」,開發者文的能力條列寫「97 種以上」。兩個數字都是 Google 自己給的,本文照原樣並列,不合併成一個。
費用與資料:兩款模型共用一張價目表
Gemini API 定價頁把 gemini-3.8-live、gemini-3.8-live-extended-thinking 與較早的 gemini-3.1-flash-live-preview 列在同一個價格區塊、共用同一組價格,也沒有寫新模型取代或停用它。發表文說 3.8 Live「為規模與成本效率打造」,那是定位說法,不是牌價比較低。
定價頁的付費層級:輸入每百萬 token 文字 0.75 美元、語音 3 美元(每分鐘 0.005 美元)、圖像影片 1 美元;輸出每百萬 token(含思考 token)文字 4.5 美元、語音 12 美元(每分鐘 0.018 美元)。開發者文引用每分鐘數字時加了註腳,說明那是用每百萬 token 價格換算的估計值。
定價頁還有免費層級:輸入輸出都寫「免費」,資料會用於改善產品,付費層級則不會。Google 搜尋即時查證(grounding)的額度列在付費層級:每月 5,000 次免費搜尋由 Gemini 3.x 系列共用,超過後每 1,000 次收費 14 美元;一次請求可能觸發不只一次查詢,每次都算費用。
模型卡另外寫了規格:兩款模型都以 Gemini 3 Pro 為基礎,輸入涵蓋音訊、圖像、影片與文字,情境窗上限 128K token;輸出音訊與文字,64K token。知識截止日是 2025 年 1 月,代表模型記得的事到那時候為止,時效性內容仍要靠另外計費的搜尋 grounding 補。
Google 沒有講的部分,以及一個編輯設計的情境
評測數字都出自 Google 發表文:Extended Thinking 在 Artificial Analysis 的 Speech to Speech Quality Index「整體第一(82.6)」,τ-Voice 68.6%、Sierra 的 τ-Voice-banking 基準 35.1%、Big Bench Audio 97.7%;3.8 Live 則在 Speech Agent Arena「第二名」。這些是 9 月 15 日的快照,本站未自行測試,排行榜會持續變動。
安全性方面,模型卡寫 Google 依前沿安全框架評估的對象是 Gemini 3.7 Flash,結果沒有觸及任何「已追蹤或關鍵能力等級」;因兩款新模型相較 3.7 Flash 沒有明顯新能力或效能實質提升,Google 表示它們「不太可能」觸及那些等級——這是從另一款模型的結果推論,不是針對這兩款模型的評估。模型卡也寫明可能出現幻覺與偶爾的遲緩或逾時,並仍在改善誘導攻擊的抵抗力。
以下是編輯設計的情境,不是實測結果。假設使用者對著行程比較表,用語音請 Extended Thinking 整理重點:依 Google 的說法,模型會先回應、把整理放到背景執行,再用進度旁白交代進度。這疊了三個還沒確定的條件:帳號要在合格地區、要用對的介面與訂閱身分;加上 2025 年 1 月的知識截止日,日期相關的細節仍要靠另外計費的搜尋 grounding。
常見問題
台灣的 Google 帳號現在可以用 Gemini 3.8 Live 或 Extended Thinking 嗎?
以本文查核到 2026 年 9 月 18 日為止,Google 的發表文、開發者文與模型卡在說明可用性時只點名產品與訂閱身分,沒有一句寫出開放的國家、地區或市場,官方未說明開放地區。文中能查到的只有身分別(開發者、企業、一般使用者、Workspace 訂閱者)與介面別的差異,沒有地區別的說明,本文無法代替 Google 確認台灣帳號是否已經可以使用。
Gemini 3.8 Live 跟 Gemini 3.8 Live Extended Thinking 差在哪裡?
Google 把 Gemini 3.8 Live 定位成為規模與成本效率打造,發表文那張可用性清單給一般使用者的通路只寫了 Search Live;Extended Thinking 定位成處理高複雜度、多步驟推理的任務,一般使用者在 Gemini Live,以及 Workspace 的文件(限 Google AI Pro 與 Ultra 訂閱者)、Gmail 與 Keep(開放給所有 Google AI 訂閱者)用得到。兩款模型在 Gemini API 上共用同一張價目表,定價頁把輸出價格註明為含思考 token。
Gemini App 裡面能不能用到這兩款新模型?
發表文那張可用性清單上,3.8 Live 對「所有人」只寫了 Search Live,Extended Thinking 寫的是 Gemini Live 與 Workspace;不過同一篇發表文的影片圖說也寫著 Extended Thinking 在 Gemini App 裡,內文與小節標題也把兩款模型合稱寫進去,沒有分開點名是哪一款。DeepMind 的模型卡則把 Gemini App 與 Google Cloud/Vertex AI 都列成兩款模型共同的通路,而發表文那張清單沒有 Vertex AI,也沒把 Gemini App 算給 3.8 Live。兩份清單的列法不同,本文把幾種寫法照原樣列出,本站無法代為判斷哪一份才是最新或最準確的狀態。
用語音會比用文字貴嗎?
以 Gemini API 定價頁的數字,語音輸入每百萬 token 3 美元、文字輸入每百萬 token 0.75 美元,語音的單位定價確實比較高;定價頁與開發者文都印了「每分鐘 0.005 美元」與「每分鐘 0.018 美元」,開發者文的註腳說明那是用每百萬 token 價格換算的估計值,定價表本身也是以每百萬 token 標價。另外還有一個免費層級,輸入與輸出都不收費,但資料會用於改善 Google 的產品。
這兩款模型知道最新發生的事嗎?
模型卡寫的知識截止日是 2025 年 1 月,也就是模型本身記得的內容到那時候為止,並不會因為主打即時對話就自動知道之後發生的事。如果需要查證時效性的內容,要靠 Google 搜尋的 grounding 功能;定價頁在付費層級那一欄列出每月 5,000 次免費額度、用量由所有 Gemini 3.x 系列模型共用,超過後每 1,000 次收費 14 美元,免費層級那一欄只寫「支援」,沒有列出額度或價格。
97 種語言是哪 97 種?
本文查核的四份文件都沒有列出語言名稱。模型發表文寫 Gemini 3.8 Live 會在對話中自動切換「97 種支援語言」,開發者文的能力條列寫「97 種以上」;兩個數字都是 Google 自己給的,本文照原樣並列,不合併成一個。另外要提醒:這個數字說的是模型在對話中聽得懂、說得出的語言,Google 沒有在這四份文件裡說明各個介面本身的介面語言或開放地區。
2026 年 AI 新聞總整理:1 月至 9 月的重點與生活應用2026 年 AI 新聞總整理:1 月至 9 月的重點與生活應用從 2026 年 1 月至 9 月,依月份整理 AI 重要新聞,連到完整解析,多數另有簡體中文、英文、日文與韓文版。涵蓋模型、工作工具、創作、費用與透明度,說明事件背景、生活用途與開放限制。閱讀全文
GPT-Live 1 開放 API:電話客服能不能接、聲音是誰的、會不會錄音GPT-Live 1 開放 API:電話客服能不能接、聲音是誰的、會不會錄音2026 年 9 月 10 日,OpenAI 的 API 更新紀錄寫下全雙工語音模型 GPT-Live 1 已在 API 正式提供,開發者可以把它接進電話客服、App 或自己的產品。本文依 OpenAI 開發者文件整理這個模型在 API 裡的規格、電話怎麼接上以及文件說這個端點不支援外撥、內建的 12 個具名語音與沒有列出的支援語言,還有錄音與每分鐘計費方式;本站沒有實測。閱讀全文
同主題延伸閱讀
生活分享
GPT-Live 1 開放 API:電話客服能不能接、聲音是誰的、會不會錄音
2026 年 9 月 10 日,OpenAI 的 API 更新紀錄寫下全雙工語音模型 GPT-Live 1 已在 API 正式提供,開發者可以把它接進電話客服、App 或自己的產品。本文依 OpenAI 開發者文件整理這個模型在 API 裡的規格、電話怎麼接上以及文件說這個端點不支援外撥、內建的 12 個具名語音與沒有列出的支援語言,還有錄音與每分鐘計費方式;本站沒有實測。
生活分享
GPT-5.5 Instant 成為 ChatGPT 預設模型:官方公布的進步、退步與新功能
2026 年 5 月 5 日,OpenAI 以 GPT-5.5 Instant 取代 GPT-5.3 Instant,成為 ChatGPT 的預設模型。本文依官方公告與系統卡,整理事實查核進步的數字、血腥與性內容兩項退步、新增個人化功能的開放對象與地區但書,以及同年 8 月 6 日官方寫明新模型將取代它的時間點,並說明官方數字為何不代表日常出錯率。
生活分享
GPT-Live 讓 ChatGPT 語音邊聽邊說:插話、方案用量與錄音設定
OpenAI 在 2026 年 7 月發布 GPT-Live,讓 ChatGPT 語音能同時聽與說、可以被插話,搜尋與推理則交給背景模型。本文依官方說明整理對話節奏的改變、9 月調整後各方案的模型與用量、做菜與練口說等使用情境、錄音保存與訓練設定,並簡短帶過 API 價格。
生活分享
NVIDIA 推出 DGX Spark 64GB 版:10 月 23 日上市、起價 4,999 美元,兩台可串接成 128GB
NVIDIA 於 2026 年 10 月 2 日宣布,個人 AI 電腦 DGX Spark 新增較平價的 64GB 記憶體版本,10 月 23 日起由 Acer、ASUS 等六家廠商供應,主要對象是想在自己機器上執行 AI 模型的開發者與研究人員。以下整理 NVIDIA 公布的規格、雙機串接說法,以及對一般讀者的意義。
引用本文的文章
最新旅遊情報攻略

情報
2026 韓國楓葉預測:雪嶽山 10 月 20 日、首爾近郊 10 月底、內藏山與漢拏山 11 月上旬
韓國山林廳 2026 年 9 月 22 日公布的楓紅高峰預測:雪嶽山 10 月 20 日,春川、國立樹木園到首爾植物園落在 10 月 28 日到 11 月 2 日,內藏山 11 月 4 日、漢拏山 11 月 6 日,整體比最近 5 年晚約 0.8 天。整理各地楓樹與銀杏的預測日、首爾出發怎麼排,以及出發前去哪裡看即時楓況。2026 年 10 月查證。
- 季節活動
- 自然
- 觀景

攻略胡志明市
胡志明市到頭頓一日遊:白藤碼頭搭高速船、船票與班次,下船就是胡梅纜車與耶穌基督像
人在胡志明市挪一天去頭頓看海:市中心的白藤高速船碼頭搭船,航程 120 分鐘到頭頓的胡梅碼頭,平日成人 320,000 越南盾、週末 350,000,回程末班平日 15:00。下船就是胡梅纜車站,同一條路上有白宮,小山頂上是耶穌基督像。平日一天只有兩班船,整天要從末班船倒推著排。
- 交通
- 行程範例
- 海灘

攻略沖繩
沖繩不開車攻略:單軌只到浦添,美麗海水族館要坐兩個多小時的巴士,回那霸的最後一班直達車 17:22 就開走
不租車的沖繩怎麼移動:那霸市區靠沖繩都市單軌電車(ゆいレール),那霸機場站到終點てだこ浦西 19 站、17 公里、37 分鐘,一日券 1,000 日圓;美麗海水族館有那霸機場直達的高速巴士,單程 2,000 日圓起、官方時刻表上 2 小時上下,下車後還要走 10 分鐘;古宇利島要在今帰仁村役場轉車,當天來回光坐車就六個半小時;回程的最後一班直達車 17:22 就從記念公園前開走(2026 年 9 月查證)。
- 交通
- 行程範例
- 預算