生活分享
Google 推出 Gemini 3.8 Live with Live Avatar:會說話、有表情的企業 AI 虛擬形象
Google 於 2026 年 9 月 24 日宣布 Gemini 3.8 Live with Live Avatar,在即時語音對話上加入近即時生成、會對嘴與做表情的虛擬人物影像,先於企業服務 Gemini Enterprise 提供。本文說明它能做什麼、有哪些限制,以及一般人可能在哪裡遇到它。
閱讀時間約 5 分鐘

Google 宣布了什麼
Google 於 2026 年 9 月 24 日在官方部落格發布 Gemini 3.8 Live with Live Avatar。Google 表示,這是延續上週 Gemini 3.8 Live 發布後的新功能,把近即時影片生成與語音結合,讓 AI 以一個能聆聽、觀看並說話的動態虛擬形象與人對話。
據 Google 說明,Live Avatar 具備精準對嘴、自然表情與流暢的輪流對話,可用於客戶服務或互動式導覽等企業情境。Google 表示,該功能自發布當天起在企業服務 Gemini Enterprise 提供,並附有 API 文件供開發者使用(API 是讓開發者把功能接入自家網站或系統的程式介面)。換句話說,它是賣給企業使用的工具,一般人多半會在企業的服務中遇到它。
閱讀完整文字說明
消息會先蒐集來源、獨立查核,再交由 Jev 判斷。
主要功能:Google 的說法
- 同時看與聽(多模態輸入):Google 稱 Live Avatar 會同時處理視覺與音訊輸入,再以帶表情的語音與影像回應。
- 邊聊邊查資料(非同步工具呼叫):Google 表示,虛擬形象可在對話持續時於背景呼叫其他工具、擷取資料,不必中斷談話;示範情境是飯店旅客入住登記。
- 多語言:Google 稱可在 97 種語言間切換,並表示不會降低影片畫質或產生視覺漂移(即畫面人物逐漸走樣、變形)。
- 自訂形象:除預設形象庫外,開發者可從高品質參考圖像生成自訂形象;Google 表示此功能目前只透過企業允許清單提供,也就是僅限經 Google 核准的企業使用。
Gemini 3.8 Live 與 Live Avatar 比較
| 項目 | Gemini 3.8 Live | 加上 Live Avatar |
|---|---|---|
| 輸出類型 | 音訊與文字 | 音訊、影片與文字 |
| 輸出上限 | 64K token | 24K token |
| 提供管道 | Gemini API、Gemini App、Google AI Studio、Gemini Enterprise Agent Platform、Google Search Live(依模型卡) | Gemini Enterprise(依 Google 部落格) |
| 連續互動時間 | 模型卡未另外註明 | 數分鐘,而非數小時(依模型卡) |
模型卡是 Google 說明模型能力、限制與安全表現的文件。根據 Google DeepMind 的模型卡,Gemini 3.8 Audio 以 Gemini 3 Pro 為基礎,Gemini 3.8 Live 的輸入可包含音訊、圖像、影片與文字,上下文視窗(模型一次能參考的內容量)最多 128K token。模型卡也提到,模型可能出現「幻覺」(說出看似合理但錯誤的內容)等基礎模型的一般限制,偶有緩慢或逾時,知識截止日期為 2025 年 1 月。
安全與透明:SynthID 浮水印
Google 表示,其 AI 產品生成的所有輸出都加上 SynthID 浮水印,並直接嵌入音訊與影片中。根據 Google DeepMind,SynthID 的浮水印人類無法察覺,但可由 SynthID 技術偵測;使用者可把圖像、影片或音訊上傳到 Gemini,詢問是否由 Google AI 生成或修改。Google DeepMind 另表示,SynthID Detector 驗證入口目前正與記者和媒體專業人士合作測試。
模型卡另稱,Google 依據 Gemini 3.7 Flash 的評估結果,認為 Gemini 3.8 Live 等模型不太可能達到其前沿安全框架中的「追蹤或關鍵能力等級」,也就是 Google 用來判斷模型能力是否需要特別管控的門檻。這是 Google 的自我評估,並非外部獨立審查結論。
常見問題
一般人現在可以使用 Live Avatar 嗎?
據 Google 部落格,Gemini 3.8 Live with Live Avatar 目前在 Gemini Enterprise 提供,主要面向企業與開發者;自訂虛擬形象更只開放給 Google 核准的企業。一般使用者較可能是在企業的客服或導覽服務中間接接觸到。
Live Avatar 能說哪些語言?
Google 表示,Live Avatar 可在 97 種語言間切換,並在對話中途轉換語言時調整對嘴與表情。Google 的公告並未列出完整語言清單。
可以跟它聊很久嗎?
不行。Google DeepMind 模型卡指出,搭配 Live Avatar 的版本可支援數分鐘的連續互動,而非數小時;也可能偶有緩慢或逾時。
怎麼知道畫面中的人物是 AI 生成的?
Google 表示其 AI 產品輸出都嵌有 SynthID 浮水印。根據 Google DeepMind,可將圖像、影片或音訊上傳到 Gemini,詢問是否由 Google AI 生成或修改。此方法只能判斷 Google AI 的內容。
這些功能說法經過獨立驗證了嗎?
沒有。本文所有資訊均來自 Google 及 Google DeepMind 官方頁面,包括功能、語言數量與安全評估,均屬 Google 自身說法。
同主題延伸閱讀
生活分享
NVIDIA 推出 DGX Spark 64GB 版:10 月 23 日上市、起價 4,999 美元,兩台可串接成 128GB
NVIDIA 於 2026 年 10 月 2 日宣布,個人 AI 電腦 DGX Spark 新增較平價的 64GB 記憶體版本,10 月 23 日起由 Acer、ASUS 等六家廠商供應,主要對象是想在自己機器上執行 AI 模型的開發者與研究人員。以下整理 NVIDIA 公布的規格、雙機串接說法,以及對一般讀者的意義。
生活分享
Google Cloud 宣布 Spanner queues 正式推出:把訊息佇列放進資料庫交易,瞄準 AI 代理可靠性
Google Cloud 宣布 Spanner queues 正式推出,讓訊息建立成為資料庫交易的一部分,目標是解決 AI 代理「狀態」與「動作」不同步的問題。本文整理官方說法、主要功能與對一般讀者的意義。
生活分享
GPT-6.1 Sol 推出:新一版 Sol 上 API、Codex 與 ChatGPT Work,Chat 裡沒有
OpenAI 在 2026 年 9 月 29 日推出 GPT-6.1 Sol,API 名稱是 gpt-6.1-sol:Plus、Pro、Business、Enterprise、Edu 方案的 Codex 與 ChatGPT Work 在首發推出範圍內,Enterprise 與 Edu 要管理員啟用,Free 與 Go 首發不含,Chat 裡沒有(2026 年 9 月查證)。
生活分享
Claude Sonnet 5.5 推出:牌價與 Sonnet 5 相同,API、雲端平台與 Claude.ai 都能用
Anthropic 在 2026 年 9 月 28 日推出 Claude Sonnet 5.5,API 牌價與 Sonnet 5 相同(每百萬 tokens 輸入 2 美元、輸出 10 美元);Claude.ai、API 與多個雲端平台可用,較高風險的資安請求會退回 Sonnet 5 處理(2026 年 9 月查證)。
最新旅遊情報攻略

情報
2026 韓國楓葉預測:雪嶽山 10 月 20 日、首爾近郊 10 月底、內藏山與漢拏山 11 月上旬
韓國山林廳 2026 年 9 月 22 日公布的楓紅高峰預測:雪嶽山 10 月 20 日,春川、國立樹木園到首爾植物園落在 10 月 28 日到 11 月 2 日,內藏山 11 月 4 日、漢拏山 11 月 6 日,整體比最近 5 年晚約 0.8 天。整理各地楓樹與銀杏的預測日、首爾出發怎麼排,以及出發前去哪裡看即時楓況。2026 年 10 月查證。
- 季節活動
- 自然
- 觀景

攻略胡志明市
胡志明市到頭頓一日遊:白藤碼頭搭高速船、船票與班次,下船就是胡梅纜車與耶穌基督像
人在胡志明市挪一天去頭頓看海:市中心的白藤高速船碼頭搭船,航程 120 分鐘到頭頓的胡梅碼頭,平日成人 320,000 越南盾、週末 350,000,回程末班平日 15:00。下船就是胡梅纜車站,同一條路上有白宮,小山頂上是耶穌基督像。平日一天只有兩班船,整天要從末班船倒推著排。
- 交通
- 行程範例
- 海灘

攻略沖繩
沖繩不開車攻略:單軌只到浦添,美麗海水族館要坐兩個多小時的巴士,回那霸的最後一班直達車 17:22 就開走
不租車的沖繩怎麼移動:那霸市區靠沖繩都市單軌電車(ゆいレール),那霸機場站到終點てだこ浦西 19 站、17 公里、37 分鐘,一日券 1,000 日圓;美麗海水族館有那霸機場直達的高速巴士,單程 2,000 日圓起、官方時刻表上 2 小時上下,下車後還要走 10 分鐘;古宇利島要在今帰仁村役場轉車,當天來回光坐車就六個半小時;回程的最後一班直達車 17:22 就從記念公園前開走(2026 年 9 月查證)。
- 交通
- 行程範例
- 預算