生活分享
Gemini 3.8 Live 与 Extended Thinking:新语音模型,你的账号能用吗?
2026 年 9 月 15 日,Google 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款语音对话模型。本文依据 Google 官方发布文章、开发者文章、模型卡与定价页,整理开发者、企业、普通用户与 Workspace 订阅者各自能用到什么、费用怎么计算,以及模型卡写明的知识截止日与官方未说明的开放地区。
阅读时间约 11 分钟

2026 年 9 月 15 日,Google 以模型发布文章与开发者文章两篇公告,发布两款语音对话模型:Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking。Google 为两款模型给出了不同定位:3.8 Live“为规模与成本效率打造,结合对话智能、流畅应答与视觉参照”;Extended Thinking“为高复杂度任务打造,具备更高智能与多步骤推理能力”。
本文于 2026 年 9 月 18 日查核 Google 的模型发布文章、开发者文章、DeepMind 模型卡与 Gemini API 定价页,内容以查核当天为准。本站没有实际使用这两款模型,文中能力、排行榜名次与价格都是 Google 的说法,以“Google 表示”标示厂商宣称;本文也不构成使用或购买建议。
这次发布了什么:两个模型,两种定位
模型发布文章把 Gemini 3.8 Live 的几项能力写在同一段文字里:能近乎实时处理视觉输入,让对话有画面可以参照;能自动检测并切换语言,发布文章写的是支持 97 种语言;也能在后台执行工具与 API 调用、同时继续对话,让用户先听到回复、工作再于后台完成。
Extended Thinking 的差异在于推理方式:Google 说明这款模型会“一边推理一边说话”,遇到需要深度推理的任务时,先用“让我确认一下”之类的话语自然承接,再用进度旁白带用户走过多步骤的后台工作;开发者文章把两款模型合称为“比级联式架构更精简的替代方案”。
开发者文章另外条列主要能力,用的是“包括”:异步函数调用、视觉情境、字母数字精确度(准确判读确认码、理赔编号与技术数据)、多语言支持(“97 种以上”语言并保持腔调一致),以及渐进式内容更新。发布文章说 Google AI 产品生成的语音都会加上 SynthID 水印,让 AI 生成内容维持可被检测。
四种身份,各自能用到哪一个模型
开发者这一侧写得最明确:Google 对两款模型都写“即日起开始推出”,渠道是 Gemini API 与 AI Studio。企业端则只在 Gemini Enterprise 开放私有预览;Customer Experience 场景与(仅 Extended Thinking)Workspace 企业用户端都还写着“即将推出”,没有时间表。
发布文章那张清单上,消费端分工是:3.8 Live 对“所有人”只写了 Search Live;Extended Thinking 写 Gemini Live,加上 Workspace 的“文档”限 Google AI Pro 与 Ultra 订阅者,“Gmail”与“Keep”则开放给所有 Google AI 订阅者——“文档”的订阅门槛比“Gmail”与“Keep”高。同一篇发布文章的视频图说另外写 Extended Thinking 在 Gemini App 里,正文与小节标题也把两款模型合称写进 Gemini App。
模型卡的渠道清单不同:两款模型一致列出 Gemini API、Gemini App、AI Studio、Vertex AI,3.8 Live 另加 Search Live,Extended Thinking 另加 Gmail、文档与 Keep 所在的 Workspace。发布文章那张清单没有 Vertex AI,也没把 Gemini App 算给 3.8 Live;本文两份照原样并列,不替 Google 认定哪一份才准。发布文章顶端另标示曾于 9 月 17 日更新。
| 身份 | 可用模型 | 开放内容 | 状态 |
|---|---|---|---|
| 开发者 | 两款皆可 | Gemini API、AI Studio | 即日起推出 |
| 企业 | 两款皆可 | Gemini Enterprise | 私有预览 |
| 普通用户 | 3.8 Live | Search Live | 即日起推出 |
| 普通用户 | Extended Thinking | Gemini Live、Gemini App | 即日起推出 |
| Workspace 订阅者 | Extended Thinking | 文档限 AI Pro/Ultra;Gmail、Keep 限 Google AI 订阅者 | 即日起推出 |
“即日起推出”不等于“现在就能用”
Google 原文写“rolling out starting today”,是开始不是完成;企业端明写是私有预览,标着“即将推出”的场景也没有时间表。查核到 2026 年 9 月 18 日,三份文档说明可用性时只点名产品与订阅身份,没有一句写出开放的国家、地区或市场,本文因此无法判断台湾账号是否已在可用范围。
企业私有预览同样没有写申请渠道或资格条件,Google 也没有讲推出什么时候算完成,用户无从判断自己什么时候会拿到。
语言数字两篇写法不同:模型发布文章写 3.8 Live 会在对话中自动切换“97 种支持语言”,开发者文章的能力条列写“97 种以上”。两个数字都是 Google 自己给的,本文照原样并列,不合并成一个。
费用与数据:两款模型共用一张价目表
Gemini API 定价页把 gemini-3.8-live、gemini-3.8-live-extended-thinking 与较早的 gemini-3.1-flash-live-preview 列在同一个价格区块、共用同一组价格,也没有写新模型取代或停用它。发布文章说 3.8 Live“为规模与成本效率打造”,那是定位说法,不是牌价比较低。
定价页的付费层级:输入每百万 token 文字 0.75 美元、语音 3 美元(每分钟 0.005 美元)、图像视频 1 美元;输出每百万 token(含思考 token)文字 4.5 美元、语音 12 美元(每分钟 0.018 美元)。开发者文章引用每分钟数字时加了脚注,说明那是用每百万 token 价格换算的估计值。
定价页还有免费层级:输入输出都写“免费”,数据会用于改善产品,付费层级则不会。Google 搜索即时查证(grounding)的额度列在付费层级:每月 5,000 次免费搜索由 Gemini 3.x 系列共用,超过后每 1,000 次收费 14 美元;一次请求可能触发不止一次查询,每次都计费。
模型卡另外写了规格:两款模型都以 Gemini 3 Pro 为基础,输入涵盖音频、图像、视频与文字,上下文窗口上限 128K token;输出音频与文字,64K token。知识截止日是 2025 年 1 月,代表模型记得的事到那时候为止,时效性内容仍要靠另外计费的搜索 grounding 补。
Google 没有讲的部分,以及一个编辑设计的情境
评测数字都出自 Google 发布文章:Extended Thinking 在 Artificial Analysis 的 Speech to Speech Quality Index“整体第一(82.6)”,τ-Voice 68.6%、Sierra 的 τ-Voice-banking 基准 35.1%、Big Bench Audio 97.7%;3.8 Live 则在 Speech Agent Arena“第二名”。这些是 9 月 15 日的快照,本站未自行测试,排行榜会持续变动。
安全性方面,模型卡写 Google 依前沿安全框架评估的对象是 Gemini 3.7 Flash,结果没有触及任何“已追踪或关键能力等级”;因两款新模型相较 3.7 Flash 没有明显新能力或性能实质提升,Google 表示它们“不太可能”触及那些等级——这是从另一款模型的结果推论,不是针对这两款模型的评估。模型卡也写明可能出现幻觉与偶尔的迟缓或超时,并仍在改善诱导攻击的抵抗力。
以下是编辑设计的情境,不是实测结果。假设用户对着行程比较表,用语音请 Extended Thinking 整理重点:依 Google 的说法,模型会先回应、把整理放到后台执行,再用进度旁白交代进度。这叠了三个还没确定的条件:账号要在合格地区、要用对的界面与订阅身份;加上 2025 年 1 月的知识截止日,日期相关的细节仍要靠另外计费的搜索 grounding。
常见问题
台湾的 Google 账号现在可以用 Gemini 3.8 Live 或 Extended Thinking 吗?
以本文查核到 2026 年 9 月 18 日为止,Google 的发布文章、开发者文章与模型卡在说明可用性时只点名产品与订阅身份,没有一句写出开放的国家、地区或市场,官方未说明开放地区。文中能查到的只有身份别(开发者、企业、普通用户、Workspace 订阅者)与界面别的差异,没有地区别的说明,本文无法代替 Google 确认台湾账号是否已经可以使用。
Gemini 3.8 Live 跟 Gemini 3.8 Live Extended Thinking 差在哪里?
Google 把 Gemini 3.8 Live 定位成为规模与成本效率打造,发布文章那张可用性清单给普通用户的渠道只写了 Search Live;Extended Thinking 定位成处理高复杂度、多步骤推理的任务,普通用户在 Gemini Live,以及 Workspace 的文档(限 Google AI Pro 与 Ultra 订阅者)、Gmail 与 Keep(开放给所有 Google AI 订阅者)用得到。两款模型在 Gemini API 上共用同一张价目表,定价页把输出价格注明为含思考 token。
Gemini App 里面能不能用到这两款新模型?
发布文章那张可用性清单上,3.8 Live 对“所有人”只写了 Search Live,Extended Thinking 写的是 Gemini Live 与 Workspace;不过同一篇发布文章的视频图说也写着 Extended Thinking 在 Gemini App 里,正文与小节标题也把两款模型合称写进去,没有分开点名是哪一款。DeepMind 的模型卡则把 Gemini App 与 Google Cloud/Vertex AI 都列成两款模型共同的渠道,而发布文章那张清单没有 Vertex AI,也没把 Gemini App 算给 3.8 Live。两份清单的列法不同,本文把几种写法照原样列出,本站无法代为判断哪一份才是最新或最准确的状态。
用语音会比用文字贵吗?
以 Gemini API 定价页的数字,语音输入每百万 token 3 美元、文字输入每百万 token 0.75 美元,语音的单位定价确实比较高;定价页与开发者文章都印了“每分钟 0.005 美元”与“每分钟 0.018 美元”,开发者文章的脚注说明那是用每百万 token 价格换算的估计值,定价表本身也是以每百万 token 标价。另外还有一个免费层级,输入与输出都不收费,但数据会用于改善 Google 的产品。
这两款模型知道最新发生的事吗?
模型卡写的知识截止日是 2025 年 1 月,也就是模型本身记得的内容到那时候为止,并不会因为主打实时对话就自动知道之后发生的事。如果需要查证时效性的内容,要靠 Google 搜索的 grounding 功能;定价页在付费层级那一栏列出每月 5,000 次免费额度、用量由所有 Gemini 3.x 系列模型共用,超过后每 1,000 次收费 14 美元,免费层级那一栏只写“支持”,没有列出额度或价格。
97 种语言是哪 97 种?
本文查核的四份文档都没有列出语言名称。模型发布文章写 Gemini 3.8 Live 会在对话中自动切换“97 种支持语言”,开发者文章的能力条列写“97 种以上”;两个数字都是 Google 自己给的,本文照原样并列,不合并成一个。另外要提醒:这个数字说的是模型在对话中听得懂、说得出的语言,Google 没有在这四份文档里说明各个界面本身的界面语言或开放地区。
2026 年 AI 新闻总整理:1 月至 9 月的重点与生活应用2026 年 AI 新闻总整理:1 月至 9 月的重点与生活应用从 2026 年 1 月至 9 月,按月份整理 AI 重要新闻,直达五语完整解析。涵盖模型、工作工具、创作、费用与透明度,说明事件背景、生活用途与开放限制。阅读全文
GPT-Live 1 开放 API:电话客服能不能接、声音是谁的、会不会录音GPT-Live 1 开放 API:电话客服能不能接、声音是谁的、会不会录音2026 年 9 月 10 日,OpenAI 的 API 更新记录写下全双工语音模型 GPT-Live 1 已在 API 正式提供,开发者可以把它接入电话客服、App 或自己的产品。本文依据 OpenAI 开发者文档整理这个模型在 API 里的规格、电话怎么接入,以及文档说明这个端点不支持外呼、内置的 12 个具名语音与没有列出的支持语言,还有录音与每分钟计费方式;本站没有实测。阅读全文
同主题延伸阅读
生活分享
GPT-Live 1 开放 API:电话客服能不能接、声音是谁的、会不会录音
2026 年 9 月 10 日,OpenAI 的 API 更新记录写下全双工语音模型 GPT-Live 1 已在 API 正式提供,开发者可以把它接入电话客服、App 或自己的产品。本文依据 OpenAI 开发者文档整理这个模型在 API 里的规格、电话怎么接入,以及文档说明这个端点不支持外呼、内置的 12 个具名语音与没有列出的支持语言,还有录音与每分钟计费方式;本站没有实测。
生活分享
GPT-5.5 Instant 成为 ChatGPT 默认模型:官方公布的进步、退步与新功能
2026 年 5 月 5 日,OpenAI 以 GPT-5.5 Instant 取代 GPT-5.3 Instant,成为 ChatGPT 的默认模型。本文依官方公告与 System Card,整理事实核查进步的数字、gore(血腥)与性内容两项退步、新增个性化功能的开放对象与地区但书,以及同年 8 月 6 日官方写明新模型将取代它的时间点,并说明官方数字为何不代表日常出错率。
生活分享
GPT-Live 让 ChatGPT 语音边听边说:插话、套餐用量与录音设置
OpenAI 在 2026 年 7 月发布 GPT-Live,让 ChatGPT 语音能同时听与说、可以被插话,搜索与推理则交给后台模型。本文依据官方说明整理对话节奏的变化、9 月调整后各套餐的模型与用量、做菜与练口语等使用场景、录音保存与训练设置,并简要带过 API 价格。
生活分享
NVIDIA 推出 DGX Spark 64GB 版:10 月 23 日上市、起价 4,999 美元,两台可串接成 128GB
NVIDIA 于 2026 年 10 月 2 日宣布,个人 AI 电脑 DGX Spark 新增较平价的 64GB 内存版本,10 月 23 日起由 Acer、ASUS 等六家厂商供应,主要面向希望在自己机器上运行 AI 模型的开发者与研究人员。以下整理 NVIDIA 公布的规格、双机串接说法,以及对普通读者的意义。
引用本文的文章
最新旅游情报攻略

攻略东京
东京住哪一区:新宿、上野、东京站、涩谷、浅草、池袋、银座七区比较,机场交通、住宿税、行李寄送一次看
东京住哪一区?用同一套标准比较新宿、上野、东京站、涩谷、浅草、池袋、银座七个区域:从成田、羽田机场怎么过来、有哪些线路、周边有什么、街区氛围、适合谁。附比较表与山手线示意图,以及 2026 年 9 月核实的东京都住宿税(2027 年 4 月改为 3%)和机场宅急便寄送行李的规则。
- 预算
- 酒店

攻略东京
东京交通票券怎么选:Suica/Welcome Suica、Tokyo Subway Ticket、JR Pass 值不值得买
第一次去东京,每人先用一张 IC 卡按次付费(Welcome Suica 免押金、有效期 28 天)。一天搭四趟以上地铁,再加买 2,000 日元的 Tokyo Subway Ticket 72 小时券;只玩东京、不去关西,买 JR Pass 一定不划算。用决策图比较 TOURIST PASMO、iPhone 里的 Suica、东京 Metro 一日券能搭什么、不能搭什么;价格于 2026 年 9 月核实。
- 交通
- 预算

攻略东京
东京迪士尼乐园、海洋攻略:票价、梦幻泉乡 Fantasy Springs、尊享卡 DPA 与预约等候卡怎么用,第一次去选哪个园区
东京迪士尼一日护照采用浮动票价,2026 年 9 月平日大多为 9,900 日元、周末为 10,900 日元,官网每天 14:00 开售两个月后同一天的门票;免费的优先通行卡已不在官网服务清单,缩短排队时间只剩付费的迪士尼尊享卡(每人每次 1,000 至 3,500 日元)。另有运营时间与 25 周年活动、预约等候卡与报名体验、梦幻泉乡如何进入,以及第一次去选乐园还是海洋;2026 年 9 月通过东京迪士尼度假区官网核实。
- 行程范例
- 亲子