ライフスタイル

Gemini 3.8 LiveとExtended Thinking:新しい音声モデル、あなたのアカウントは使えるか

2026年9月15日、Googleは音声対話モデル「Gemini 3.8 Live」と「Gemini 3.8 Live Extended Thinking」の2機種を発表しました。本稿はGoogle公式の発表文、開発者向け記事、モデルカード、料金ページをもとに、開発者・企業・一般ユーザー・Workspace加入者それぞれが使える範囲、料金の仕組み、モデルカードに記された知識のカットオフ日、そして公式が明記していない提供地域を整理します。

読了目安 17 分

オリジナルイラスト:左側の角丸の吹き出しに音波を表す線が並び、音声対話を表す。矢印が右側の4つの四角を指し、4種類の利用者区分を表す。そのうち2つは実線、2つは破線の枠で、同時発表でも開放度が異なることを象徴する。
画像:Mokaair (© Mokaair)

2026年9月15日、Googleはモデル発表文と開発者向け記事という2本の公式発表で、音声対話モデル2機種を発表しました。Gemini 3.8 LiveとGemini 3.8 Live Extended Thinkingです。Googleは両モデルに異なる位置づけを与えています。3.8 Liveは「規模とコスト効率のために作られ、対話的な知性と流暢な受け答え、視覚的な参照を組み合わせている」、Extended Thinkingは「複雑度の高いタスクのために作られ、より高い知性と多段階の推論能力を備えている」としています。

本稿は2026年9月18日に、Googleのモデル発表文、開発者向け記事、DeepMindのモデルカード、Gemini APIの料金ページを確認しました。内容は確認当日時点のものです。当サイトはこの2つのモデルを実際には使用しておらず、本文中の性能、リーダーボードの順位、価格はすべてGoogle自身の説明であり、ベンダー側の主張には「Googleによれば」と明記します。本稿は利用や購入を勧めるものでもありません。

今回発表されたもの:2つのモデル、2つの位置づけ

モデル発表文は、Gemini 3.8 Liveのいくつかの能力を同じ段落にまとめています。視覚入力をほぼリアルタイムで処理でき、会話に参照できる画面を持てること。言語を自動的に検知して切り替えられること(発表文は97種類の言語に対応するとしています)。そしてツールやAPI呼び出しをバックグラウンドで実行しながら会話を続けられ、ユーザーはまず応答を聞き、作業はその裏側で完了するということです。

Extended Thinkingの違いは推論の仕方にあります。Googleはこのモデルが「考えながら話す」と説明しており、深い推論を要するタスクに直面すると、まず「確認させてください」といった言葉で自然に間をつなぎ、その後は進捗を伝えるナレーションでユーザーを多段階のバックグラウンド処理へと導きます。開発者向け記事は両モデルを合わせて「カスケード型アーキテクチャに代わる、より簡潔な選択肢」と呼んでいます。

開発者向け記事はさらに主な能力を「含む」という言葉で列挙しています。非同期の関数呼び出し、視覚的コンテキスト、英数字の精度(確認コードや保険金請求番号、技術データを正確に読み取る)、多言語対応(アクセントの一貫性を保ちながら「97種類以上」の言語)、そして段階的なコンテンツ更新です。発表文は、Google AI製品が生成する音声にはすべてSynthIDの電子透かしが付き、AI生成コンテンツを検知可能な状態に保つとしています。

4種類の利用者、それぞれが使えるモデル

最も明確に書かれているのは開発者側です。Googleは両モデルについて「本日より順次提供開始」としており、窓口はGemini APIとAI Studioです。企業向けはGemini Enterpriseでの非公開プレビューのみで、Customer Experience向けの場面と(Extended Thinkingのみ)Workspace法人ユーザー向けはいずれも「近日提供予定」とされ、時期は示されていません。

発表文の一覧表では、消費者向けの振り分けは次のとおりです。3.8 Liveは「すべての人向け」の欄にSearch Liveとだけ書かれています。Extended ThinkingはGemini Liveに加え、WorkspaceのうちGoogle AI ProとUltraの加入者に限定される「ドキュメント」、そしてすべてのGoogle AI加入者が使える「Gmail」と「Keep」に書かれています。つまりドキュメントの加入条件はGmailやKeepより厳しいということです。同じ発表文の動画キャプションには、別途Extended ThinkingがGemini Appにあるとも書かれており、本文と小見出しにも両モデルをまとめてGemini Appに含めて記す箇所があります。

モデルカードの窓口一覧は異なります。両モデルとも共通してGemini API、Gemini App、AI Studio、Vertex AIが挙げられ、3.8 LiveにはさらにSearch Liveが、Extended ThinkingにはさらにGmail・ドキュメント・Keepを含むWorkspaceが加わります。発表文の一覧表にはVertex AIがなく、Gemini Appも3.8 Liveには数えられていません。本稿はこの2つの一覧をそのまま並べて示すにとどめ、どちらが正しいかをGoogleに代わって判断することはしません。発表文の冒頭には、9月17日に更新された旨の表示もあります。

Googleの2026年9月15日の発表文とモデルカードをもとに整理。確認日は2026年9月18日。モデルカードはさらにGemini AppとVertex AIを両モデル共通の窓口として挙げています。
利用者区分使えるモデル提供内容状況
開発者両方Gemini API、AI Studio本日より順次提供開始
企業両方Gemini Enterprise非公開プレビュー
一般ユーザー3.8 LiveSearch Live本日より順次提供開始
一般ユーザーExtended ThinkingGemini Live、Gemini App本日より順次提供開始
Workspace加入者Extended ThinkingドキュメントはAI Pro/Ultra限定、GmailとKeepはGoogle AI加入者向け本日より順次提供開始

「本日より順次提供開始」は「今すぐ使える」ではない

Google原文は「rolling out starting today」と書いており、これは開始であって完了ではありません。企業向けは明確に非公開プレビューとされ、「近日提供予定」と記された場面にも時期は示されていません。2026年9月18日時点で確認したところ、3つの文書はいずれも提供状況を説明する際に製品名と加入区分だけを挙げており、開放された国・地域・市場を一つも明記していないため、本稿は台湾のアカウントがすでに利用可能な範囲に入っているかどうかを判断できません。

企業向けの非公開プレビューについても、申込み方法や資格条件は書かれておらず、Googleは展開がいつ完了するとも述べていないため、ユーザーは自分がいつ使えるようになるか判断できません。

言語数の書き方は2つの文書で異なります。モデル発表文は3.8 Liveが会話中に「97種類の対応言語」を自動的に切り替えるとし、開発者向け記事の能力一覧は「97種類以上」としています。どちらもGoogle自身が示した数字であり、本稿は両方をそのまま並べて示し、1つにまとめることはしません。

4コマ図解:開発者・企業・消費者・Workspaceという4種類の利用者それぞれの提供状況。商標やインターフェース画面は含まない
Googleの2026年9月15日の発表をもとに整理:開発者・企業・消費者・Workspaceという4種類の利用者の提供状況。確認日は2026年9月18日。 · 画像:Mokaair (© Mokaair)

料金とデータ:両モデルが共有する1つの価格表

Gemini APIの料金ページは、gemini-3.8-live、gemini-3.8-live-extended-thinking、そしてそれより前からあるgemini-3.1-flash-live-previewを同じ価格区分にまとめ、同じ価格を共有させています。新モデルがこれを置き換える、または提供終了にするとも書かれていません。発表文が3.8 Liveを「規模とコスト効率のために作られた」とするのは位置づけの説明であり、定価が安いという意味ではありません。

料金ページの有料枠は、入力が100万トークンあたりテキスト0.75米ドル、音声3米ドル(1分あたり0.005米ドル)、画像・動画1米ドル。出力は100万トークンあたり(思考トークンを含む)テキスト4.5米ドル、音声12米ドル(1分あたり0.018米ドル)です。開発者向け記事は1分あたりの数字を引用する際に脚注を付け、それが100万トークンあたりの価格から換算した推定値であると説明しています。

料金ページには無料枠もあります。入力・出力とも「無料」ですが、データは製品改善に使われ、有料枠ではそうなりません。Google検索によるgrounding(検索を通じたリアルタイムの裏付け)の枠は有料枠に記載されており、月5,000回までの無料検索をGemini 3.xシリーズ全体で共有し、それを超えると1,000回あたり14米ドルが課金されます。1回のリクエストで複数回のクエリが発生することもあり、その都度課金されます。

モデルカードにはさらに仕様が書かれています。両モデルともGemini 3 Proをベースとし、入力は音声・画像・動画・テキストに対応し、コンテキストウィンドウは最大128Kトークン。出力は音声とテキストで64Kトークンです。知識のカットオフ日は2025年1月で、モデル自身が記憶している内容はそこまでという意味であり、即時性のある内容は別料金の検索groundingで補う必要があります。

Googleが述べていないこと、そして編集部が作成したシナリオ1つ

評価指標の数字はすべてGoogleの発表文によるものです。Extended ThinkingはArtificial AnalysisのSpeech to Speech Quality Indexで「総合1位(82.6)」、τ-Voiceで68.6%、Sierraのτ-Voice-banking基準で35.1%、Big Bench Audioで97.7%。3.8 LiveはSpeech Agent Arenaで「2位」です。これらは9月15日時点のスナップショットであり、当サイトは自ら検証しておらず、順位表は今後も変動します。

安全性について、モデルカードはGoogleがフロンティア安全性フレームワークに基づいて評価した対象がGemini 3.7 Flashであり、結果はどの「Tracked または Critical Capability Level」にも達しなかったと記しています。2つの新モデルは3.7 Flashと比べて明確な新能力や実質的な性能向上が見られないため、Googleはこれらも「達する可能性は低い」としていますが、これは別モデルの結果からの推論であり、この2つのモデル自体を対象にした評価ではありません。モデルカードはまた、幻覚が起こり得ることや、時折の遅延・タイムアウト、ジェイルブレイクへの耐性向上が引き続き課題であることも記しています。

以下は編集部が作成したシナリオであり、実際に試した結果ではありません。ユーザーが旅程の比較表を見ながら、音声でExtended Thinkingに要点の整理を頼んだとします。Googleの説明によれば、モデルはまず応答し、整理作業をバックグラウンドに回し、その後は進捗をナレーションで伝えます。これには、アカウントが対象地域にあること、正しいインターフェースと加入区分を使っていることという、まだ確定していない条件が3つ重なっています。さらに2025年1月という知識のカットオフ日があるため、日付に関わる細部は依然として別料金の検索groundingに頼ることになります。

よくある質問

台湾のGoogleアカウントは、今すぐGemini 3.8 LiveやExtended Thinkingを使えますか。

本稿が2026年9月18日まで確認した範囲では、Googleのモデル発表文、開発者向け記事、モデルカードはいずれも提供状況を説明する際に製品名と加入区分だけを挙げており、開放された国・地域・市場を一つも明記していません。公式は提供地域を明記していないということです。本文で分かるのは利用者区分(開発者、企業、一般ユーザー、Workspace加入者)とインターフェースによる違いだけで、地域による違いの説明はなく、本稿は台湾のアカウントがすでに使えるかどうかをGoogleに代わって確認することはできません。

Gemini 3.8 LiveとGemini 3.8 Live Extended Thinkingはどう違いますか。

GoogleはGemini 3.8 Liveを規模とコスト効率のために作られたものと位置づけており、発表文の一覧表が一般ユーザーに示す窓口はSearch Liveだけです。Extended Thinkingは複雑度が高く多段階の推論を要するタスク向けに位置づけられ、一般ユーザーはGemini Liveのほか、Workspaceのドキュメント(Google AI ProとUltraの加入者限定)、Gmail、Keep(すべてのGoogle AI加入者が利用可)で使えます。両モデルはGemini API上で同じ価格表を共有しており、料金ページは出力価格が思考トークンを含むと注記しています。

Gemini Appの中でこの2つの新モデルを使えますか。

発表文の一覧表では、3.8 Liveの「すべての人向け」の欄にはSearch Liveだけが書かれ、Extended ThinkingにはGemini LiveとWorkspaceが書かれています。ただし同じ発表文の動画キャプションにはExtended ThinkingがGemini Appにあるとも書かれており、本文と小見出しにも両モデルをまとめてそこに記す箇所があって、どちらか一方だけを名指ししてはいません。一方、DeepMindのモデルカードはGemini AppとGoogle Cloud/Vertex AIの両方を両モデル共通の窓口として挙げていますが、発表文の一覧表にはVertex AIがなく、Gemini Appも3.8 Liveには数えられていません。2つの一覧は書き方が異なっており、本稿はそれぞれの記述をそのまま並べるにとどめ、どちらが最新か、あるいはより正確かを当サイトが代わりに判断することはできません。

音声を使うとテキストより高くなりますか。

Gemini APIの料金ページの数字では、音声入力は100万トークンあたり3米ドル、テキスト入力は100万トークンあたり0.75米ドルで、音声の単価が高いのは事実です。料金ページと開発者向け記事にはそれぞれ「1分あたり0.005米ドル」「1分あたり0.018米ドル」とも印刷されていますが、開発者向け記事の脚注はこれが100万トークンあたりの価格から換算した推定値だと説明しており、料金表自体は100万トークン単位で表示されています。このほか無料枠もあり、入力・出力とも課金されませんが、データはGoogleの製品改善に使われます。

この2つのモデルは最近起きたことを知っていますか。

モデルカードに記された知識のカットオフ日は2025年1月です。つまりモデル自身が記憶している内容はそこまでで、即時対話を売りにしているからといって、それ以降に起きたことを自動的に知るわけではありません。即時性のある内容を確認するにはGoogle検索のgrounding機能に頼る必要があります。料金ページの有料枠の欄には月5,000回までの無料枠があり、利用量はGemini 3.xシリーズ全体で共有され、それを超えると1,000回あたり14米ドルが課金されると記されている一方、無料枠の欄には「対応」とだけ書かれ、枠や価格は示されていません。

97種類の言語とは具体的にどの言語ですか。

本稿が確認した4つの文書のいずれにも言語名の一覧はありません。モデル発表文はGemini 3.8 Liveが会話中に「97種類の対応言語」を自動的に切り替えるとし、開発者向け記事の能力一覧は「97種類以上」としています。どちらもGoogle自身が示した数字であり、本稿は両方をそのまま並べて示し、1つにまとめることはしません。なお、この数字はモデルが会話の中で聞き取り、話せる言語を指すものであり、Googleはこの4つの文書の中で各インターフェース自体の表示言語や提供地域については説明していません。

  • ライフスタイル

    GPT-Live 1がAPIで正式提供開始:電話対応はできるのか、声は誰のものか、録音されるのか

    2026年9月10日、OpenAIのAPI更新履歴に、全二重音声モデルGPT-Live 1がAPIで正式提供されたと記載されました。開発者はこれを電話対応、アプリ、または自社製品に組み込めます。本記事はOpenAI開発者向けドキュメントに基づき、このモデルのAPI仕様、電話の接続方法、そしてこのエンドポイントは発信に対応しないとドキュメントが述べていること、内蔵された12種類の名前付き音声とドキュメントに記載のない対応言語、録音の扱いと分単位の課金方式を整理しました。当サイトは実地の検証を行っておりません。

  • ライフスタイル

    GPT-5.5 InstantがChatGPTの既定モデルに:公式発表の進歩・後退・新機能

    2026年5月5日、OpenAIはGPT-5.3 InstantをGPT-5.5 Instantに切り替え、ChatGPTの既定モデルとしました。本稿はOpenAIの公式発表とSystem Cardに基づき、事実確認で公表された改善の数値、gore(グロテスクな残虐表現)と性的コンテンツという2つの後退、新しい個人化機能の対象者と地域による但し書き、同年8月6日に公式が新モデルによる置き換えを予告した時点、そして公式の数値が日常のエラー率を意味しない理由を整理します。

  • ライフスタイル

    GPT-LiveでChatGPTの音声が聞きながら話せるように:割り込み、プラン別の利用枠、録音の設定

    OpenAIは2026年7月にGPT-Liveを発表し、ChatGPTの音声モードで聞き取りと発話を同時に行い、途中で割り込めるようにしました。検索や推論はバックグラウンドのモデルが担います。本稿では公式の説明に基づき、会話のリズムの変化、9月の変更後のプラン別モデルと利用枠、料理や会話練習などの利用場面、録音の保存と学習の設定を整理し、APIの料金にも簡単に触れます。

  • ライフスタイル

    NVIDIA、DGX Spark 64GB版を発表:10月23日発売、価格は4,999ドルから、2台接続で128GBに

    NVIDIAは2026年10月2日、パーソナルAIコンピューター「DGX Spark」に、より手頃な64GBメモリ版を追加すると発表した。10月23日からAcer、ASUSなど6社が供給し、主な対象は自分のマシンでAIモデルを実行したい開発者や研究者。NVIDIAが公表した仕様、2台接続に関する説明、一般読者にとっての意味を整理する。

最新の旅の情報・ガイド

出典

ライフスタイル