ライフスタイル

NVIDIAのAI Infra Summit講演から:Vera RubinとDSXに何が加わったか

2026年9月15日、NVIDIAは米カリフォルニア州サンタクララで開催されたAI Infra Summitで、Vera Rubinプラットフォームとデータセンター向け電力管理ソフトウェアDSXを紹介し、AIインフラを測る指標がピーク性能から1メガワットあたりのトークン生産量へと移りつつあると述べました。本記事はNVIDIAが同日公開した公式ブログ記事、および1月と8月の公式プレスリリースを確認し、この日に新しく加わったもの、実測値と言えるもの、NVIDIA自身が予測値だと明記しているもの、そして公式がまだ説明していない部分を整理します。

読了目安 19 分

オリジナルイラスト:左から順にチップ、ラック、データセンターの建物を矢印でつなぎ、さらにデータセンターから破線で送電鉄塔へとつなぐことで、チップ・ラック・データセンター・電力網という4つの階層を表現
画像:Mokaair (© Mokaair)

2026年9月15日、NVIDIA公式ブログが同日公開したまとめ記事によると、NVIDIA副社長のIan Buck氏は米カリフォルニア州サンタクララ・コンベンションセンターで開催されたAI Infra Summitで、AIファクトリー(NVIDIAがAI向けデータセンターを指して使う呼称)の効率をテーマに講演し、これを自身のインフラ基調講演の中心に据えました。

本記事は2026年9月17日に確認しており、NVIDIAが9月15日に公開した公式ブログ記事2本の全文、および比較の基準として参照した1月5日と8月24日の公式プレスリリース2本を根拠にしています。当サイトは実地の検証を行っておらず、購入や買い替えを勧めるものでもありません。以下の数値はすべて、NVIDIA自身が実測したもの、NVIDIA自身が予測したもの、あるいは公式が転載した第三者機関のテスト結果のいずれかであることを明記します。

9月15日に何があったのか:ピーク性能から1メガワットあたりのトークン数へ

NVIDIAはこのまとめ記事で、AIインフラを測る指標がピーク性能から、検証済みのエージェント型(agentic)の1メガワットあたりトークン数へと急速に移りつつあり、AIファクトリーはチップから電力網まで一体で設計する必要があると述べています。この一文が9月15日と1月のCES発表を分ける境目です。1月はチップの仕様と1トークンあたりのコストの話で、9月はデータセンター全体が1メガワットの電力からどれだけの生産量を引き出せるかという話になっています。

9月15日付の2本の発表に新しいチップの発表はなく、NVIDIAが挙げたのはエコシステムでの提携とパートナーによる実測結果です。NVIDIAによれば、Amazon傘下のAnnapurna LabsはNVIDIAとカスタム高帯域幅メモリ技術NVHBMを共同開発中であり、d-MatrixはNVLink Fusionを統合してNVIDIA Vera CPUと自社のRaptor XPUを組み合わせ、大規模な超低遅延推論を実現しようとしており、PinterestはBlackwellプラットフォームと推論ソフトウェアDynamoを採用して対話型AIをビジュアル探索に取り入れているとのことです。この3件について公式はそれぞれ一文しか触れておらず、仕様やスケジュールはありません。同じ発表には、複数のスタートアップによるVera CPUのテスト結果や、NVLink 6の信頼性に関する一節も含まれています。

1月と比べて何が変わったのか:チップは同じ、測る指標が変わった

1月5日、NVIDIAはCESでRubinプラットフォームを発表し、これを6種類の新しいチップ(Vera CPU、Rubin GPUなど)と呼びました。目玉となる数値は性能面のもので、Blackwellプラットフォームと比べて推論の1トークンあたりコストを最大10分の1に、混合エキスパート(MoE)モデルの学習に必要なGPU数を最大4分の1に削減できるとし、プレスリリースは未来形で、関連製品はパートナーから2026年後半に提供される見込みだと記していました。8月24日のHot Chipsカンファレンスでは、NVIDIAはGroq 3 LPXが完全量産段階に入ったと発表し、プラットフォーム全体で7種類のチップと5種類の専用ラックにまたがるとしました。商標に関する注記にはGroqとLPUの名称がGroq, Inc.からライセンスを受けて使用されているとあるのみで、本記事が確認した公式文書にはNVIDIAがGroqを買収・合併したという記述はありません。

9月15日になると、2本の公式ブログ記事にはもはや新しいチップ名は登場しません。1月のプレスリリースは全文を通じてメガワットを測定単位として使っていなかったのに対し、9月15日の2本の記事は成果を1メガワットあたりのトークン生産量で繰り返し表現しています。つまり9月15日に新しく加わったのはハードウェアではなく、電力管理ソフトウェアDSXが初のパートナー実測と商用実証の段階に進んだという点です。

NVIDIAが2026年1月5日、8月24日、9月15日、9月16日に発表した内容をもとに作成。確認日 2026年9月17日。
時期発表の主な内容NVIDIAが示した数値と条件
2026-01-05CES:Rubin 6チップ・プラットフォームを発表NVIDIAは、Blackwellと比べ推論コストを最大10分の1、学習GPU数を最大4分の1に削減できるとした
2026-08-24Hot Chips:Groq 3 LPXが量産段階入りを発表NVIDIAはプラットフォーム全体で計7チップ・5ラックに及ぶとし、GroqとLPUの名称はGroq, Inc.からのライセンスとした
2026-09-15AI Infra Summit:DSX電力ソフトウェアとパートナー実測NVIDIAはLambdaがスループット24%増を測定したとし、Vera Rubin NVL72の40%はNVIDIA自身の予測値とした
2026-09-16同記事にMLPerf Inference v6.1のプレビュー結果を追記NVIDIAはVera Rubin NVL72のスループットがGB300 NVL72の最大3.7倍としている

なぜ電力がボトルネックなのか:DSX MaxLPSとDSX Flexは何をしているのか

NVIDIAは創業者兼CEOのジェンスン・フアン氏の言葉を引いて、電力がなぜボトルネックなのかを説明しています。「1ギガワットの工場が2ギガワットの工場になることは決してない」とフアン氏は述べています。NVIDIAは同じ記事の中で、電力こそがAIファクトリーの経済における制約条件だと記しています。DSXというソフトウェア自体は9月15日に初めて登場したものではなく、公式によれば、DSXは5月にGTC Taipei(NVIDIAが台湾で開催するイベント)で発表されたとのことで、年は明記されていません。9月15日付の2本の発表はいずれも台湾での展開、パートナー、サプライチェーンについてそれ以上は触れておらず、本記事も公式に代わって補うことはしません。

DSX MaxLPSはデータセンター内部の電力配分を担うソフトウェアです。NVIDIAによれば、AIファクトリー単位では、MaxLPSが需要の増減に応じてラック間で動的に電力を振り分け、同じサイト電力枠(site-power envelope)の中で最大40%多くのGPUを収容でき、新たな送電線を敷設しなくても最大35%高いトークンスループットを実現できるとしています。ラック単位では別に、電力平滑化ソフトウェアと拡張されたエネルギー蓄積が短時間のピークを吸収しますが、公式はこの階層では数値を示していません。この一連の電力に関する数値のうち、パートナーによる実測があるのはLambdaのケースです。85%の電力ポリシーの下で19ノードを、フル稼働時16ノードと同じ電力予算内で稼働させ、NVIDIAによればクラスターのスループットが24%、ワットあたり性能が23%向上したとのことですが、これはVera RubinではなくBlackwell世代のHGX B200サーバーでのテストであり、Lambdaのクラウドサービス部門プレジデントはこれを概念実証と呼んでいます。この40%という数値がVera Rubin NVL72に当てはめられる際には、対になる公式記事の方で、NVIDIA自身の予測値に基づくものであり適切な導入環境に限られると明記されており、同記事の数値一覧表にはさらに、MaxLPSとデータセンターの電力計画を組み合わせた結果であって実測値ではないと記されています。

DSX Flexはデータセンターと電力網との間のやり取りを担うソフトウェアです。負荷遮断要請、デマンドレスポンスのイベント、電力価格シグナルを受け取り、あらかじめ定めた作業優先順位の範囲内で自動的に反応し、最も重要な処理は稼働を続けさせ、それ以外はいったん停止してから再開させます。NVIDIAが挙げる例は、自社のEosデータセンターがシリコンバレー電力会社の柔軟な負荷連系プログラムに参加し、Emerald AIのConductorと組み合わせたケースです。本文では、ある8月の夜に電力が自動的に4メガワットから3メガワットへ下がったと記されており、同じページの写真キャプションにも同じ2つの数値が記されています。ところが同記事の別の数値一覧表では、同じ実証が1分以内に電力需要を40%削減したものとして記されており、NVIDIAは両者の関係を説明していません。公式によれば、その後シリコンバレー電力会社から200回を超える需要シグナルが送られ、いずれも成功したとのことですが、この実証はまだ正式なDSX Flexの導入ではなく、概念が成り立つことを示したに過ぎません。

4コマ図解:チップ・ラック・データセンター・電力網という4つの階層での電力とスループットの調整
NVIDIAが2026年9月15日に公開した2本のブログ記事をもとに作成。確認日 2026年9月17日。 · 画像:Mokaair (© Mokaair)

NVIDIAが示す数値をどう読むか:どれが実測でどれが予測か

Groq 3 LPXを組み合わせた場合のNVIDIAの目玉数値は、2兆パラメータ超の長コンテキストモデルにおいて、統合プラットフォームの1メガワットあたりトークンスループットがGB200 NVL72の最大35倍になるというものです。より具体的な数値としては、10万トークンのコンテキストを持つQwen 3.8 27Bという負荷において、Groq 3 LPXが1ユーザーあたり毎秒2,529個の出力トークンを記録したというものがあります。いずれも比較の基準を伴う数値であり、条件を外して単独で引用すると実態と異なって伝わります。NVIDIAはまた、第三者機関SemiAnalysisが独自のAgentX手法で測定した結果も転載しています。DeepSeek V4 Proモデルにおいて、Vera Rubin NVL72はGB300 NVL72に対して1メガワットあたりスループットが最大30倍になるというもので、これはNVIDIAが他機関のテストを転載しているものであり、当サイトは元データを入手していません。

供給状況について、9月15日付の2本のブログ記事が述べているのは一文だけです。Vera Rubinはすでに完全量産段階にあり、エコシステム全体で導入が拡大しており、性能はソフトウェアの最適化に伴って今後も向上する、というもので、出荷台数、顧客リスト、対応するクラウドのリージョン一覧は示されていません。この記事は更新が続く生きた記事であり、イベント翌日の9月16日にはMLPerf Inference v6.1の結果が一節追加されました。NVIDIAはこれをVera Rubin NVL72にとって初めてのMLPerfプレビュー提出だとし、スループットはGB300 NVL72の最大3.7倍としています。この内容は9月16日のものであり、9月15日当日に起きたことではありません。

クラウドサービスの利用者にとって何を意味するのか、そして公式が語っていないこと

ここまでの数値はいずれもデータセンター単位の指標であり、1メガワットあたりのトークン生産量、ワットあたり性能、同じ電力枠の中でどれだけのGPUを収容できるかを示すもので、末端のクラウドサービスの速度や料金、提供時期を約束するものは一つもありません。ハードウェアの効率化が月額料金に反映されるかどうかについては、以前のCES関連記事ですでに推論コストと末端価格のギャップを取り上げているため、ここでは繰り返しません。9月15日付の2本の発表には、Vera Rubin、Groq 3 LPX、DSXのいずれについても価格やライセンス料への言及は一切なく、価格という言葉が出てくるのは電力網の価格シグナルを説明する箇所だけです。

2026年9月17日時点で確認した限り、2本の発表には「Taiwan」も「TSMC」も登場せず、台湾での展開やパートナー、サプライチェーンについての説明もありません。台湾に関連するのは前の節で触れたとおり、DSXがGTC Taipeiで発表されたという点のみです。読者が自分で最新状況を確認したい場合は、この2本のブログ記事そのものに立ち返ることができますが、サミットのまとめ記事の最終更新時刻は確認期間中にさらに後ろへ動いています。読者が今後さらに更新された版を目にした場合は、その時点の公式ページの内容を優先してください。

よくある質問

このAI Infra Summitで新しいチップは発表されましたか。

いいえ。Vera Rubinプラットフォームは2026年1月5日に発表されたもので、Groq 3 LPXは8月24日に量産段階入りが発表されたものです。9月15日、NVIDIA公式ブログが取り上げたのは電力管理ソフトウェア、パートナーによる初の実測結果、そして複数のスタートアップがVera CPUで行ったテスト結果であり、本記事が確認した2本の発表に新しいチップ名は登場しません。

DSX MaxLPSによってVera RubinのAIファクトリーで最大40%多くのGPUを収容できるとされていますが、これは実測結果ですか。

いいえ。この40%は、同じ電力予算の中でGPUを40%多く収容できるという意味です。「From Megawatts to Tokens」という公式記事では、NVIDIA自身の予測値に基づくものであり適切な導入環境に限られると明記されており、同記事の数値一覧表ではさらに、MaxLPSとデータセンターの電力計画を組み合わせた結果だとされています。一方、同日公開されたサミットのまとめ記事では、同じ内容に「予測」という言葉は付いていません。この2本の記事のうち実測値と言えるのはLambdaのテストで、スループットが24%、ワットあたり性能が23%向上したというものですが、使われたのはVera RubinではなくBlackwell世代のHGX B200サーバーであり、Lambdaのクラウドサービス部門プレジデント自身がこれを概念実証と呼んでいます。

シリコンバレー電力会社との負荷遮断の実証実験で、電力は実際にどれだけ下がったのですか。

NVIDIAは同じ記事の中で2通りの説明をしています。本文と同じページの写真キャプションはいずれも、電力が自動的に4メガワットから3メガワットへ下がったとしていますが、別の数値一覧表では同じ実証を1分以内に電力需要を40%削減したものとして記しています。NVIDIAはこの2つの数値の関係を自ら説明しておらず、本記事もどちらか一方を唯一の答えとせず、両方を併記しています。

この件は台湾と関係がありますか。

本記事が確認した9月15日付の2本の発表には、台湾も台湾積体電路製造(TSMC)も登場しません。唯一の関連は、DSXという電力管理ソフトウェア自体が、NVIDIAが台湾で開催するイベントGTC Taipeiで5月に発表されたという点だけです。発表はそれ以上、台湾での展開やパートナー、サプライチェーンの詳細には触れておらず、本記事も公式に代わって補うことはしません。

Vera Rubinは今すぐ購入できますか。価格はいくらですか。

公式の説明では、すでに完全量産段階にあり、エコシステム全体で導入が拡大しているとされていますが、出荷台数、顧客リスト、対応するクラウドのリージョン一覧は公表されていません。1月のプレスリリースはパートナー製品を2026年後半に提供予定としていましたが、9月15日の資料でもこの時期は更新されていません。本記事が確認した9月15日付の2本の発表には、Vera Rubin、Groq 3 LPX、DSXのいずれについても価格やライセンス料は記載されておらず、本記事は導入すべきかどうかの助言も行いません。

SemiAnalysisが示したという30倍とはどういう意味ですか。

これはNVIDIAが第三者機関SemiAnalysisの測定結果として転載しているもので、同機関独自のAgentX手法によるものです。DeepSeek V4 Proモデルにおいて、Vera Rubin NVL72はGB300 NVL72に対して1メガワットあたりスループットが最大30倍になるとされています。これはNVIDIAが他機関のテスト結果を引用しているものであり、当サイトはSemiAnalysisの元データを入手していないため、NVIDIAがどのように引用しているかを記録するにとどめます。

最新の旅の情報・ガイド

出典

ライフスタイル