ライフスタイル
NVIDIA:クラウド事業者CoreWeaveがAI向け新システムVera Rubin NVL72の提供を開始、Cognitionが初の本番顧客に
NVIDIAブログによると、AI向けクラウド事業者CoreWeaveが、NVIDIAの次世代AIシステム「Vera Rubin NVL72」のクラウド提供、AIエージェント向けVera CPUの導入予定、AIモデルとエージェントを改善するプラットフォーム「CoreWeave Forge」を発表しました。AIサービスを支える基盤の変化として、要点と一般読者への影響を整理します。
読了目安 9 分

何が起きたのか
NVIDIAブログは2026年9月30日、CoreWeaveが今週サンフランシスコで開催中のイベント「CoreWeave Fully Connected」で発表を行ったと伝えました。発表内容は、Spectrum-X 102.4Tイーサネットを組み合わせたNVIDIA Vera Rubin NVL72システムの提供です。NVIDIAによれば、これによりCoreWeaveは、同プラットフォームを顧客に届けた最初期のクラウドプロバイダーの一つとなりました。
NVIDIAブログによると、AIソフトウェアエンジニア「Devin」を開発する応用AIラボのCognitionが、Vera Rubin上で本番ワークロードを稼働させる初の顧客です。NVIDIAの説明では、CoreWeaveは今月に入ってVera Rubin NVL72の初回本番ラック(サーバー機器を収めた設備)を受け取り、数日のうちにCognition向けの本番クラスターを構築しました。
詳しい説明を読む
情報源を収集し、独立検証を行ってから Jev が判断します。
さらにNVIDIAによると、CoreWeaveはNVIDIA Vera CPUも提供する予定です。また、NVIDIAのアクセラレーテッドコンピューティング上でモデルやエージェントの学習・評価・改善を行う統合環境「CoreWeave Forge」も発表しました。NVIDIAバイスプレジデントのIan Buck氏は、Volta登場から約10年が経つ今も、CoreWeaveのV100 GPUが顧客のワークロードを実行していると指摘しています。
NVIDIAが公表した性能データ
NVIDIAブログによると、Cognitionは推論(学習済みのAIが実際に回答やコードを生成する処理)の性能をテストしました。比較の基準にはGB200 NVL72を使い、テスト内容は、FrontierCodeからサンプリングしたタスクをAIエージェントが解く、実際のソフトウェアエンジニアリングのワークロードです。初期テストでは、SWE-2推論ワークロードで、Vera Rubin NVL72の総トークンスループットが最大4.8倍に向上しました。Cognition創業チームメンバーのSilas Alberti氏は、エージェント型のコーディングは長いコンテキスト、高い並列性、大量のトークンを伴うと説明しています。そのうえで、トークンあたりのコストが自社で何をリリースできるかを左右すると述べています。
CPUについてNVIDIAは、CoreWeaveのVera導入では1ラックに128基のCPU、11,264コアを搭載するとしています。1環境につき1コアを使う場合、11,000を超える並列環境を支えられる計算です。CoreWeaveはテストで、エージェントサンドボックス(他の処理から切り離してAIエージェントを安全に動かす実行環境)の起動速度が3倍以上向上したと確認しました。また、Terminal-Benchの合格タスク全体で1.7倍の性能向上も確認しています。
| 項目 | NVIDIAブログの記載内容 | 状況 |
|---|---|---|
| Vera Rubin NVL72 | GB200 NVL72比でSWE-2推論の総トークンスループットが最大4.8倍(Cognitionの初期テスト) | CoreWeave Cloudで提供を発表 |
| NVIDIA Vera CPU | 1ラックに128基のCPU、11,264コア。サンドボックス起動が3倍以上高速 | CoreWeave Cloudに搭載予定 |
| CoreWeave ARIA | 実験の分析、実験やコード変更の提案を支援 | 一般提供 |
| CoreWeave Sandboxes | 隔離されたCPUまたはGPU環境でエージェント、RL(強化学習)、評価を実行 | 一般提供 |
| CoreWeave Agent Lens | 障害検出が20%向上、修復コストが半減(公式発表) | 新サービス |
| RL Rollouts | 稼働中に新しいチェックポイント(学習途中のモデルの保存データ)を読み込み、再デプロイ不要 | プライベートプレビュー |
CoreWeave Forgeとは
NVIDIAブログによると、CoreWeave Forgeは次の三つを一つの環境に統合したものです。Weights & Biases、OpenPipeのポストトレーニング(学習済みモデルを追加で調整すること)の専門性、そしてオープンソースのmarimoノートブックプロジェクトです。狙いは、本番環境でのふるまいを次の学習に反映させることで、モデル、フレームワーク、クラウドをまたいでオープンであり続けるとしています。このうちARIAとSandboxesは一般提供されており、Agent Lensは新サービスです。
NVIDIAはさらに、サーバーレス(利用者が自分でサーバーを管理しなくてよい形態)の強化学習(試行錯誤を通じてAIを改善する学習手法)について説明しています。自己管理の構成と比べて、学習が1.4倍速く、コストが40%低いとしています。オープンソースの推論フレームワークNVIDIA Dynamoは、CoreWeaveのマネージド推論サービスと、プライベートプレビュー中のRL Rolloutsを支えています。NVIDIAによれば、Canva、Capital One、MasterClassがForge上で開発を行う最初期の企業です。
一般読者にとっての意味
このニュースのポイントは、次世代のAIハードウェアがクラウドの本番環境に入り始めたことです。AIコーディングアシスタントなどのエージェント型サービスは、大量の計算資源を必要とします。NVIDIAが述べるスループット向上が実際の利用でも成り立てば、エンドユーザーは応答の高速化や多段階推論の円滑化を実感できるかもしれません。NVIDIAは医療の例も挙げています。同社によると、15州にまたがり約50,000人のMedicare患者にサービスを提供するEnnoble Careが、CoreWeave上でRTX PRO 6000 GPUを使う予定です。用途は、臨床文書作成、意思決定支援、バックオフィス自動化のためのAIエージェントの拡大です。
- 一般ユーザーが対応すべきことはありません。これはクラウドおよび企業レベルのインフラ更新です。
- 開発者にとっては、隔離サンドボックスやポストトレーニングツールの一般提供により、AIエージェント構築のハードルが下がる可能性があります。ただし、判断は自身のテスト結果を基準にすべきです。
- 性能数値はベンダーとパートナーによるものであり、今後独立した評価が出るかどうかが注目点です。
よくある質問
Vera Rubin NVL72とは何ですか?
NVIDIAブログによると、NVIDIAの次世代AIインフラシステムです。CoreWeaveが自社クラウドで、Spectrum-X 102.4Tイーサネットと組み合わせて提供すると発表しました。
4.8倍の性能向上は信頼できますか?
これはNVIDIAがCognitionの初期テストを引用した結果で、SWE-2推論ワークロードにおける「最大」の向上幅です。比較基準はGB200 NVL72で、第三者による検証結果は示されていません。
最初のユーザーは誰ですか?
NVIDIAブログによると、Devinを開発するCognitionが、Vera Rubin上で本番ワークロードを稼働させる初の顧客です。
Vera CPUは一般的なCPUと何が違いますか?
NVIDIAはVeraをAIエージェント向けに設計した初のCPUとしており、多数の隔離されたエージェント環境を同時に実行することに重点を置いています。CoreWeaveの導入では1ラックあたり11,264コアを備えます。
普段使っているAIサービスに影響はありますか?
間接的に影響する可能性があります。インフラの性能がNVIDIAの述べる通りに向上すれば、これらのクラウドサービスを採用するAIアプリの応答が速くなるかもしれません。ただし、実際の効果は各サービス事業者の導入状況によります。
同じテーマの記事
ライフスタイル
CloudflareがStreamlineをオープンソース化:自社クラウドサービスでライブ配信への画像追加や動画への字幕焼き込みを行う方法を実演
Cloudflareは2026年10月2日、開発者向け実験プラットフォーム「Streamline」を公開し、オープンソース化しました。Stream、Workers、Containers、Durable Objectsを組み合わせ、ライブ配信へのリアルタイムなアイコン追加や動画への字幕追加といった動画処理フローを開発者が自ら構築する方法を示すものです。本記事では、その概要、仕組み、制限、そして視聴者と開発者にとっての意味を解説します。
ライフスタイル
Google、Gemini 4 Argonを発表:まずサイバー防御者に提供、一般ユーザーはまだ待つ必要
Googleは2026年9月30日、フロンティアモデル「Gemini 4 Argon」を発表しました。現時点ではFairwind Programを通じて信頼できるサイバー防御者にのみ提供されています。本記事では、Googleが公表した性能、価格、安全対策と一般読者への影響を整理します。データはすべてGoogle自身によるものです。
ライフスタイル
Google Cloud、Spanner Omniを正式提供開始:Spannerデータベースを自社データセンターや他社クラウドでも運用可能に
Google Cloudは、分散データベースSpannerを自社データセンターや他社クラウド、ノートPCでも動かせる「Spanner Omni」の一般提供(GA、正式版としての提供)を発表した。規制や既存設備の事情でGoogle Cloudを使いにくい企業にも選択肢が広がる一方、運用は利用企業が担う。Google Cloudが公表した機能、ライセンス、フルマネージド版との違いをまとめる。
ライフスタイル
Google Cloud、CLI リモート MCP サーバーをプレビュー公開:AI エージェントが gcloud と bq コマンドを直接実行可能に
Google Cloud は、Google Cloud CLI リモート MCP サーバーのパブリックプレビューを発表した。MCP 対応の AI エージェントが、クラウド上の隔離されたサンドボックスで gcloud と bq コマンドを実行できる。本記事では、その仕組み、Google が説明するセキュリティ機能、料金、一般読者への影響を整理する。
最新の旅の情報・ガイド

ガイド東京
東京ではどのエリアに泊まる?新宿・上野・東京駅・渋谷・浅草・池袋・銀座の七エリア比較。空港アクセス、宿泊税、荷物配送も解説
東京ではどのエリアに泊まる?新宿、上野、東京駅、渋谷、浅草、池袋、銀座の七エリアを同じ基準で比較。成田・羽田空港からのアクセス、利用できる路線、周辺にあるもの、街の雰囲気、向いている人を、比較表と山手線の概略図とともに紹介します。2026年9月に確認した東京都の宿泊税(2027年4月から3%)と、空港宅急便で荷物を送る際のルールも解説します。
- 予算
- ホテル

ガイド東京
東京の交通パスの選び方:Suica/Welcome Suica、Tokyo Subway Ticket、JR Passは買うべき?
初めての東京では、まず一人一枚ICカードで都度払い(Welcome Suicaはデポジット不要、有効期間28日)。一日に地下鉄へ4回以上乗るならTokyo Subway Ticketの72時間券2,000円を追加し、関西へ行かず東京だけならJR Passは必ず割高です。TOURIST PASMO、iPhoneのSuica、東京メトロ一日乗車券で乗れる路線・乗れない路線を決定チャートで比較。価格は2026年9月に確認。
- 交通
- 予算

ガイド東京
東京ディズニーランド・シー攻略:チケット料金、ファンタジースプリングス、ディズニー・プレミアアクセス(DPA)とスタンバイパスの使い方、初めてならどちらを選ぶ?
東京ディズニーの一日パスポートは変動価格制で、2026 年 9 月は平日の多くが 9,900 円、週末が 10,900 円。公式サイトでは毎日 14:00 に二か月後の同日分を発売します。無料のプライオリティパスは公式サイトのサービス一覧に載っておらず、待ち時間を短縮できるのは有料のディズニー・プレミアアクセス(一人一回 1,000~3,500 円)のみ。運営時間、25 周年イベント、スタンバイパス、エントリー受付、ファンタジースプリングスの利用方法、初回にランドとシーのどちらを選ぶかも解説。2026 年 9 月に公式サイトで確認しました。
- モデルコース
- 家族向け