ライフスタイル
NVIDIAのAI Infra Summit講演から:Vera RubinとDSXに何が加わったか
2026年9月15日、NVIDIAは米カリフォルニア州サンタクララで開催されたAI Infra Summitで、Vera Rubinプラットフォームとデータセンター向け電力管理ソフトウェアDSXを紹介し、AIインフラを測る指標がピーク性能から1メガワットあたりのトークン生産量へと移りつつあると述べました。本記事はNVIDIAが同日公開した公式ブログ記事、および1月と8月の公式プレスリリースを確認し、この日に新しく加わったもの、実測値と言えるもの、NVIDIA自身が予測値だと明記しているもの、そして公式がまだ説明していない部分を整理します。
読了目安 19 分

2026年9月15日、NVIDIA公式ブログが同日公開したまとめ記事によると、NVIDIA副社長のIan Buck氏は米カリフォルニア州サンタクララ・コンベンションセンターで開催されたAI Infra Summitで、AIファクトリー(NVIDIAがAI向けデータセンターを指して使う呼称)の効率をテーマに講演し、これを自身のインフラ基調講演の中心に据えました。
本記事は2026年9月17日に確認しており、NVIDIAが9月15日に公開した公式ブログ記事2本の全文、および比較の基準として参照した1月5日と8月24日の公式プレスリリース2本を根拠にしています。当サイトは実地の検証を行っておらず、購入や買い替えを勧めるものでもありません。以下の数値はすべて、NVIDIA自身が実測したもの、NVIDIA自身が予測したもの、あるいは公式が転載した第三者機関のテスト結果のいずれかであることを明記します。
9月15日に何があったのか:ピーク性能から1メガワットあたりのトークン数へ
NVIDIAはこのまとめ記事で、AIインフラを測る指標がピーク性能から、検証済みのエージェント型(agentic)の1メガワットあたりトークン数へと急速に移りつつあり、AIファクトリーはチップから電力網まで一体で設計する必要があると述べています。この一文が9月15日と1月のCES発表を分ける境目です。1月はチップの仕様と1トークンあたりのコストの話で、9月はデータセンター全体が1メガワットの電力からどれだけの生産量を引き出せるかという話になっています。
9月15日付の2本の発表に新しいチップの発表はなく、NVIDIAが挙げたのはエコシステムでの提携とパートナーによる実測結果です。NVIDIAによれば、Amazon傘下のAnnapurna LabsはNVIDIAとカスタム高帯域幅メモリ技術NVHBMを共同開発中であり、d-MatrixはNVLink Fusionを統合してNVIDIA Vera CPUと自社のRaptor XPUを組み合わせ、大規模な超低遅延推論を実現しようとしており、PinterestはBlackwellプラットフォームと推論ソフトウェアDynamoを採用して対話型AIをビジュアル探索に取り入れているとのことです。この3件について公式はそれぞれ一文しか触れておらず、仕様やスケジュールはありません。同じ発表には、複数のスタートアップによるVera CPUのテスト結果や、NVLink 6の信頼性に関する一節も含まれています。
1月と比べて何が変わったのか:チップは同じ、測る指標が変わった
1月5日、NVIDIAはCESでRubinプラットフォームを発表し、これを6種類の新しいチップ(Vera CPU、Rubin GPUなど)と呼びました。目玉となる数値は性能面のもので、Blackwellプラットフォームと比べて推論の1トークンあたりコストを最大10分の1に、混合エキスパート(MoE)モデルの学習に必要なGPU数を最大4分の1に削減できるとし、プレスリリースは未来形で、関連製品はパートナーから2026年後半に提供される見込みだと記していました。8月24日のHot Chipsカンファレンスでは、NVIDIAはGroq 3 LPXが完全量産段階に入ったと発表し、プラットフォーム全体で7種類のチップと5種類の専用ラックにまたがるとしました。商標に関する注記にはGroqとLPUの名称がGroq, Inc.からライセンスを受けて使用されているとあるのみで、本記事が確認した公式文書にはNVIDIAがGroqを買収・合併したという記述はありません。
9月15日になると、2本の公式ブログ記事にはもはや新しいチップ名は登場しません。1月のプレスリリースは全文を通じてメガワットを測定単位として使っていなかったのに対し、9月15日の2本の記事は成果を1メガワットあたりのトークン生産量で繰り返し表現しています。つまり9月15日に新しく加わったのはハードウェアではなく、電力管理ソフトウェアDSXが初のパートナー実測と商用実証の段階に進んだという点です。
| 時期 | 発表の主な内容 | NVIDIAが示した数値と条件 |
|---|---|---|
| 2026-01-05 | CES:Rubin 6チップ・プラットフォームを発表 | NVIDIAは、Blackwellと比べ推論コストを最大10分の1、学習GPU数を最大4分の1に削減できるとした |
| 2026-08-24 | Hot Chips:Groq 3 LPXが量産段階入りを発表 | NVIDIAはプラットフォーム全体で計7チップ・5ラックに及ぶとし、GroqとLPUの名称はGroq, Inc.からのライセンスとした |
| 2026-09-15 | AI Infra Summit:DSX電力ソフトウェアとパートナー実測 | NVIDIAはLambdaがスループット24%増を測定したとし、Vera Rubin NVL72の40%はNVIDIA自身の予測値とした |
| 2026-09-16 | 同記事にMLPerf Inference v6.1のプレビュー結果を追記 | NVIDIAはVera Rubin NVL72のスループットがGB300 NVL72の最大3.7倍としている |
なぜ電力がボトルネックなのか:DSX MaxLPSとDSX Flexは何をしているのか
NVIDIAは創業者兼CEOのジェンスン・フアン氏の言葉を引いて、電力がなぜボトルネックなのかを説明しています。「1ギガワットの工場が2ギガワットの工場になることは決してない」とフアン氏は述べています。NVIDIAは同じ記事の中で、電力こそがAIファクトリーの経済における制約条件だと記しています。DSXというソフトウェア自体は9月15日に初めて登場したものではなく、公式によれば、DSXは5月にGTC Taipei(NVIDIAが台湾で開催するイベント)で発表されたとのことで、年は明記されていません。9月15日付の2本の発表はいずれも台湾での展開、パートナー、サプライチェーンについてそれ以上は触れておらず、本記事も公式に代わって補うことはしません。
DSX MaxLPSはデータセンター内部の電力配分を担うソフトウェアです。NVIDIAによれば、AIファクトリー単位では、MaxLPSが需要の増減に応じてラック間で動的に電力を振り分け、同じサイト電力枠(site-power envelope)の中で最大40%多くのGPUを収容でき、新たな送電線を敷設しなくても最大35%高いトークンスループットを実現できるとしています。ラック単位では別に、電力平滑化ソフトウェアと拡張されたエネルギー蓄積が短時間のピークを吸収しますが、公式はこの階層では数値を示していません。この一連の電力に関する数値のうち、パートナーによる実測があるのはLambdaのケースです。85%の電力ポリシーの下で19ノードを、フル稼働時16ノードと同じ電力予算内で稼働させ、NVIDIAによればクラスターのスループットが24%、ワットあたり性能が23%向上したとのことですが、これはVera RubinではなくBlackwell世代のHGX B200サーバーでのテストであり、Lambdaのクラウドサービス部門プレジデントはこれを概念実証と呼んでいます。この40%という数値がVera Rubin NVL72に当てはめられる際には、対になる公式記事の方で、NVIDIA自身の予測値に基づくものであり適切な導入環境に限られると明記されており、同記事の数値一覧表にはさらに、MaxLPSとデータセンターの電力計画を組み合わせた結果であって実測値ではないと記されています。
DSX Flexはデータセンターと電力網との間のやり取りを担うソフトウェアです。負荷遮断要請、デマンドレスポンスのイベント、電力価格シグナルを受け取り、あらかじめ定めた作業優先順位の範囲内で自動的に反応し、最も重要な処理は稼働を続けさせ、それ以外はいったん停止してから再開させます。NVIDIAが挙げる例は、自社のEosデータセンターがシリコンバレー電力会社の柔軟な負荷連系プログラムに参加し、Emerald AIのConductorと組み合わせたケースです。本文では、ある8月の夜に電力が自動的に4メガワットから3メガワットへ下がったと記されており、同じページの写真キャプションにも同じ2つの数値が記されています。ところが同記事の別の数値一覧表では、同じ実証が1分以内に電力需要を40%削減したものとして記されており、NVIDIAは両者の関係を説明していません。公式によれば、その後シリコンバレー電力会社から200回を超える需要シグナルが送られ、いずれも成功したとのことですが、この実証はまだ正式なDSX Flexの導入ではなく、概念が成り立つことを示したに過ぎません。
NVIDIAが示す数値をどう読むか:どれが実測でどれが予測か
Groq 3 LPXを組み合わせた場合のNVIDIAの目玉数値は、2兆パラメータ超の長コンテキストモデルにおいて、統合プラットフォームの1メガワットあたりトークンスループットがGB200 NVL72の最大35倍になるというものです。より具体的な数値としては、10万トークンのコンテキストを持つQwen 3.8 27Bという負荷において、Groq 3 LPXが1ユーザーあたり毎秒2,529個の出力トークンを記録したというものがあります。いずれも比較の基準を伴う数値であり、条件を外して単独で引用すると実態と異なって伝わります。NVIDIAはまた、第三者機関SemiAnalysisが独自のAgentX手法で測定した結果も転載しています。DeepSeek V4 Proモデルにおいて、Vera Rubin NVL72はGB300 NVL72に対して1メガワットあたりスループットが最大30倍になるというもので、これはNVIDIAが他機関のテストを転載しているものであり、当サイトは元データを入手していません。
供給状況について、9月15日付の2本のブログ記事が述べているのは一文だけです。Vera Rubinはすでに完全量産段階にあり、エコシステム全体で導入が拡大しており、性能はソフトウェアの最適化に伴って今後も向上する、というもので、出荷台数、顧客リスト、対応するクラウドのリージョン一覧は示されていません。この記事は更新が続く生きた記事であり、イベント翌日の9月16日にはMLPerf Inference v6.1の結果が一節追加されました。NVIDIAはこれをVera Rubin NVL72にとって初めてのMLPerfプレビュー提出だとし、スループットはGB300 NVL72の最大3.7倍としています。この内容は9月16日のものであり、9月15日当日に起きたことではありません。
クラウドサービスの利用者にとって何を意味するのか、そして公式が語っていないこと
ここまでの数値はいずれもデータセンター単位の指標であり、1メガワットあたりのトークン生産量、ワットあたり性能、同じ電力枠の中でどれだけのGPUを収容できるかを示すもので、末端のクラウドサービスの速度や料金、提供時期を約束するものは一つもありません。ハードウェアの効率化が月額料金に反映されるかどうかについては、以前のCES関連記事ですでに推論コストと末端価格のギャップを取り上げているため、ここでは繰り返しません。9月15日付の2本の発表には、Vera Rubin、Groq 3 LPX、DSXのいずれについても価格やライセンス料への言及は一切なく、価格という言葉が出てくるのは電力網の価格シグナルを説明する箇所だけです。
2026年9月17日時点で確認した限り、2本の発表には「Taiwan」も「TSMC」も登場せず、台湾での展開やパートナー、サプライチェーンについての説明もありません。台湾に関連するのは前の節で触れたとおり、DSXがGTC Taipeiで発表されたという点のみです。読者が自分で最新状況を確認したい場合は、この2本のブログ記事そのものに立ち返ることができますが、サミットのまとめ記事の最終更新時刻は確認期間中にさらに後ろへ動いています。読者が今後さらに更新された版を目にした場合は、その時点の公式ページの内容を優先してください。
よくある質問
このAI Infra Summitで新しいチップは発表されましたか。
いいえ。Vera Rubinプラットフォームは2026年1月5日に発表されたもので、Groq 3 LPXは8月24日に量産段階入りが発表されたものです。9月15日、NVIDIA公式ブログが取り上げたのは電力管理ソフトウェア、パートナーによる初の実測結果、そして複数のスタートアップがVera CPUで行ったテスト結果であり、本記事が確認した2本の発表に新しいチップ名は登場しません。
DSX MaxLPSによってVera RubinのAIファクトリーで最大40%多くのGPUを収容できるとされていますが、これは実測結果ですか。
いいえ。この40%は、同じ電力予算の中でGPUを40%多く収容できるという意味です。「From Megawatts to Tokens」という公式記事では、NVIDIA自身の予測値に基づくものであり適切な導入環境に限られると明記されており、同記事の数値一覧表ではさらに、MaxLPSとデータセンターの電力計画を組み合わせた結果だとされています。一方、同日公開されたサミットのまとめ記事では、同じ内容に「予測」という言葉は付いていません。この2本の記事のうち実測値と言えるのはLambdaのテストで、スループットが24%、ワットあたり性能が23%向上したというものですが、使われたのはVera RubinではなくBlackwell世代のHGX B200サーバーであり、Lambdaのクラウドサービス部門プレジデント自身がこれを概念実証と呼んでいます。
シリコンバレー電力会社との負荷遮断の実証実験で、電力は実際にどれだけ下がったのですか。
NVIDIAは同じ記事の中で2通りの説明をしています。本文と同じページの写真キャプションはいずれも、電力が自動的に4メガワットから3メガワットへ下がったとしていますが、別の数値一覧表では同じ実証を1分以内に電力需要を40%削減したものとして記しています。NVIDIAはこの2つの数値の関係を自ら説明しておらず、本記事もどちらか一方を唯一の答えとせず、両方を併記しています。
この件は台湾と関係がありますか。
本記事が確認した9月15日付の2本の発表には、台湾も台湾積体電路製造(TSMC)も登場しません。唯一の関連は、DSXという電力管理ソフトウェア自体が、NVIDIAが台湾で開催するイベントGTC Taipeiで5月に発表されたという点だけです。発表はそれ以上、台湾での展開やパートナー、サプライチェーンの詳細には触れておらず、本記事も公式に代わって補うことはしません。
Vera Rubinは今すぐ購入できますか。価格はいくらですか。
公式の説明では、すでに完全量産段階にあり、エコシステム全体で導入が拡大しているとされていますが、出荷台数、顧客リスト、対応するクラウドのリージョン一覧は公表されていません。1月のプレスリリースはパートナー製品を2026年後半に提供予定としていましたが、9月15日の資料でもこの時期は更新されていません。本記事が確認した9月15日付の2本の発表には、Vera Rubin、Groq 3 LPX、DSXのいずれについても価格やライセンス料は記載されておらず、本記事は導入すべきかどうかの助言も行いません。
SemiAnalysisが示したという30倍とはどういう意味ですか。
これはNVIDIAが第三者機関SemiAnalysisの測定結果として転載しているもので、同機関独自のAgentX手法によるものです。DeepSeek V4 Proモデルにおいて、Vera Rubin NVL72はGB300 NVL72に対して1メガワットあたりスループットが最大30倍になるとされています。これはNVIDIAが他機関のテスト結果を引用しているものであり、当サイトはSemiAnalysisの元データを入手していないため、NVIDIAがどのように引用しているかを記録するにとどめます。
2026年テクノロジーニュースまとめ:ハードウェア、プラットフォーム、通信、法規制の要点2026年テクノロジーニュースまとめ:ハードウェア、プラットフォーム、通信、法規制の要点当サイトの2026年のテクノロジーニュース解説を、ハードウェア、プラットフォーム、コンピューティング基盤、台湾の政策、EUの規制という5つのグループにまとめました。iPhone Duoと9月の新製品、M6とM5 Ultra、Snapdragon 8 Elite Gen 6、Project Zenith、Pixel Drop、App Store定期購読の新ルール、WordPressとSynologyのセキュリティ修正、NVIDIAの3件の発表、6G周波数シンポジウム、台馬海底ケーブル、主権AIコーパス、サイバーレジリエンス法の通報義務、KIDS Act提案、AppleのEU App条件とトラッキング確認画面を扱います。購入の助言はせず、ベンダーの主張には必ず帰属を明記し、各記事に公式情報源と確認日を添えています。記事全文を読む
NVIDIA、オープンソースのCUDA-QにCUDA-Q Logicalを追加――誤り耐性量子コンピュータの規模を見積もるツール、量子コンピュータ本体ではないNVIDIA、オープンソースのCUDA-QにCUDA-Q Logicalを追加――誤り耐性量子コンピュータの規模を見積もるツール、量子コンピュータ本体ではない2026年9月14日、NVIDIAはオープンソースのCUDA-Qプラットフォームに新しいオーケストレーション層CUDA-Q Logicalを追加すると発表しました。これは研究者が誤り耐性量子コンピューティング向けアプリケーションに必要なハードウェア量を見積もるのを助けるものであり、新しい量子コンピュータではありません。本記事はNVIDIAのプレスリリースと技術文書に基づき、このツールにできることとできないこと、両者の記述の食い違い、そしてサンディア国立研究所が開発したクロスプラットフォームベンチマークQUOPSについて説明します。確認日は2026年9月17日です。記事全文を読む
同じテーマの記事
ライフスタイル
NVIDIA RubinがCESで登場:AI計算能力の向上が日常サービスに及ぼす影響とは?
NVIDIA Rubinデータセンター基盤が日常のクラウドAIサービスに与える実質的影響を分析し、推論コスト、待ち時間、企業の請求額との関連性を考察します。
ライフスタイル
NVIDIA、オープンソースのCUDA-QにCUDA-Q Logicalを追加――誤り耐性量子コンピュータの規模を見積もるツール、量子コンピュータ本体ではない
2026年9月14日、NVIDIAはオープンソースのCUDA-Qプラットフォームに新しいオーケストレーション層CUDA-Q Logicalを追加すると発表しました。これは研究者が誤り耐性量子コンピューティング向けアプリケーションに必要なハードウェア量を見積もるのを助けるものであり、新しい量子コンピュータではありません。本記事はNVIDIAのプレスリリースと技術文書に基づき、このツールにできることとできないこと、両者の記述の食い違い、そしてサンディア国立研究所が開発したクロスプラットフォームベンチマークQUOPSについて説明します。確認日は2026年9月17日です。
ライフスタイル
NVIDIAがMediaTekに35億ドル出資:提携深化の発表と転換社債届出書がそれぞれ書いていること
2026年8月31日、NVIDIAとMediaTekはAIインフラ、エッジAIコンピューティング、車載の3分野で提携を深化すると発表し、NVIDIAはMediaTekが発行する転換社債に35億ドルを出資しました。本記事は両社の公式プレスリリースと、MediaTekが台湾の公開情報観測サイト(MOPS)に提出した価格決定に関する届出書に基づき、プレスリリースに書かれていること、届出書だけが明らかにしている発行条件、そしてこれらの文書が説明していない部分を整理します。確認日は2026年9月17日です。
ライフスタイル
Cloudflare、Traces をパブリックベータで提供開始:サイト運営者はリクエストがプラットフォームを通過する各ステップを1本のタイムラインで確認可能に
Cloudflare は2026年10月2日、Cloudflare Traces のパブリックベータ提供を発表した。Cloudflare を利用するサイト運営者や開発者は、リクエストがセキュリティルール、キャッシュ、ルーティング、オリジンサーバーを通過する過程を1本のタイムラインで確認でき、リクエストがブロックされたり遅くなったりした原因を特定しやすくなる。新しい料金体系は2026年12月1日から適用される。情報は Cloudflare 公式ブログによる。
この記事を引用している記事
最新の旅の情報・ガイド

ガイド東京
東京ではどのエリアに泊まる?新宿・上野・東京駅・渋谷・浅草・池袋・銀座の七エリア比較。空港アクセス、宿泊税、荷物配送も解説
東京ではどのエリアに泊まる?新宿、上野、東京駅、渋谷、浅草、池袋、銀座の七エリアを同じ基準で比較。成田・羽田空港からのアクセス、利用できる路線、周辺にあるもの、街の雰囲気、向いている人を、比較表と山手線の概略図とともに紹介します。2026年9月に確認した東京都の宿泊税(2027年4月から3%)と、空港宅急便で荷物を送る際のルールも解説します。
- 予算
- ホテル

ガイド東京
東京の交通パスの選び方:Suica/Welcome Suica、Tokyo Subway Ticket、JR Passは買うべき?
初めての東京では、まず一人一枚ICカードで都度払い(Welcome Suicaはデポジット不要、有効期間28日)。一日に地下鉄へ4回以上乗るならTokyo Subway Ticketの72時間券2,000円を追加し、関西へ行かず東京だけならJR Passは必ず割高です。TOURIST PASMO、iPhoneのSuica、東京メトロ一日乗車券で乗れる路線・乗れない路線を決定チャートで比較。価格は2026年9月に確認。
- 交通
- 予算

ガイド東京
東京ディズニーランド・シー攻略:チケット料金、ファンタジースプリングス、ディズニー・プレミアアクセス(DPA)とスタンバイパスの使い方、初めてならどちらを選ぶ?
東京ディズニーの一日パスポートは変動価格制で、2026 年 9 月は平日の多くが 9,900 円、週末が 10,900 円。公式サイトでは毎日 14:00 に二か月後の同日分を発売します。無料のプライオリティパスは公式サイトのサービス一覧に載っておらず、待ち時間を短縮できるのは有料のディズニー・プレミアアクセス(一人一回 1,000~3,500 円)のみ。運営時間、25 周年イベント、スタンバイパス、エントリー受付、ファンタジースプリングスの利用方法、初回にランドとシーのどちらを選ぶかも解説。2026 年 9 月に公式サイトで確認しました。
- モデルコース
- 家族向け
出典
- AI Infra Summit: NVIDIA Vera Rubin and DSX Platform Advancements Showcase Energy Efficiencies of Optimizing Tokens Per Watt for AI Factories · 確認日:
- From Megawatts to Tokens: How NVIDIA Maximizes AI Factory Production · 確認日:
- NVIDIA Kicks Off the Next Generation of AI With Rubin — Six New Chips, One Incredible AI Supercomputer · 確認日:
- NVIDIA Groq 3 LPX Now in Full Production With World-Class Speed for Agentic AI · 確認日: