ライフスタイル

NVIDIA:クラウド事業者CoreWeaveがAI向け新システムVera Rubin NVL72の提供を開始、Cognitionが初の本番顧客に

NVIDIAブログによると、AI向けクラウド事業者CoreWeaveが、NVIDIAの次世代AIシステム「Vera Rubin NVL72」のクラウド提供、AIエージェント向けVera CPUの導入予定、AIモデルとエージェントを改善するプラットフォーム「CoreWeave Forge」を発表しました。AIサービスを支える基盤の変化として、要点と一般読者への影響を整理します。

読了目安 9 分

NVIDIA:クラウド事業者CoreWeaveがAI向け新システムVera Rubin NVL72の提供を開始、Cognitionが初の本番顧客に
画像:Mokaair (Original editorial artwork)

何が起きたのか

NVIDIAブログは2026年9月30日、CoreWeaveが今週サンフランシスコで開催中のイベント「CoreWeave Fully Connected」で発表を行ったと伝えました。発表内容は、Spectrum-X 102.4Tイーサネットを組み合わせたNVIDIA Vera Rubin NVL72システムの提供です。NVIDIAによれば、これによりCoreWeaveは、同プラットフォームを顧客に届けた最初期のクラウドプロバイダーの一つとなりました。

NVIDIAブログによると、AIソフトウェアエンジニア「Devin」を開発する応用AIラボのCognitionが、Vera Rubin上で本番ワークロードを稼働させる初の顧客です。NVIDIAの説明では、CoreWeaveは今月に入ってVera Rubin NVL72の初回本番ラック(サーバー機器を収めた設備)を受け取り、数日のうちにCognition向けの本番クラスターを構築しました。

NVIDIA:クラウド事業者CoreWeaveがAI向け新システムVera Rubin NVL72の提供を開始、Cognitionが初の本番顧客に
Mokaair 編集検証フロー · 画像:Mokaair (Original editorial artwork)
詳しい説明を読む

情報源を収集し、独立検証を行ってから Jev が判断します。

さらにNVIDIAによると、CoreWeaveはNVIDIA Vera CPUも提供する予定です。また、NVIDIAのアクセラレーテッドコンピューティング上でモデルやエージェントの学習・評価・改善を行う統合環境「CoreWeave Forge」も発表しました。NVIDIAバイスプレジデントのIan Buck氏は、Volta登場から約10年が経つ今も、CoreWeaveのV100 GPUが顧客のワークロードを実行していると指摘しています。

NVIDIAが公表した性能データ

NVIDIAブログによると、Cognitionは推論(学習済みのAIが実際に回答やコードを生成する処理)の性能をテストしました。比較の基準にはGB200 NVL72を使い、テスト内容は、FrontierCodeからサンプリングしたタスクをAIエージェントが解く、実際のソフトウェアエンジニアリングのワークロードです。初期テストでは、SWE-2推論ワークロードで、Vera Rubin NVL72の総トークンスループットが最大4.8倍に向上しました。Cognition創業チームメンバーのSilas Alberti氏は、エージェント型のコーディングは長いコンテキスト、高い並列性、大量のトークンを伴うと説明しています。そのうえで、トークンあたりのコストが自社で何をリリースできるかを左右すると述べています。

CPUについてNVIDIAは、CoreWeaveのVera導入では1ラックに128基のCPU、11,264コアを搭載するとしています。1環境につき1コアを使う場合、11,000を超える並列環境を支えられる計算です。CoreWeaveはテストで、エージェントサンドボックス(他の処理から切り離してAIエージェントを安全に動かす実行環境)の起動速度が3倍以上向上したと確認しました。また、Terminal-Benchの合格タスク全体で1.7倍の性能向上も確認しています。

CoreWeave関連の新サービスとNVIDIA公表データのまとめ(出典:NVIDIAブログ)
項目NVIDIAブログの記載内容状況
Vera Rubin NVL72GB200 NVL72比でSWE-2推論の総トークンスループットが最大4.8倍(Cognitionの初期テスト)CoreWeave Cloudで提供を発表
NVIDIA Vera CPU1ラックに128基のCPU、11,264コア。サンドボックス起動が3倍以上高速CoreWeave Cloudに搭載予定
CoreWeave ARIA実験の分析、実験やコード変更の提案を支援一般提供
CoreWeave Sandboxes隔離されたCPUまたはGPU環境でエージェント、RL(強化学習)、評価を実行一般提供
CoreWeave Agent Lens障害検出が20%向上、修復コストが半減(公式発表)新サービス
RL Rollouts稼働中に新しいチェックポイント(学習途中のモデルの保存データ)を読み込み、再デプロイ不要プライベートプレビュー

CoreWeave Forgeとは

NVIDIAブログによると、CoreWeave Forgeは次の三つを一つの環境に統合したものです。Weights & Biases、OpenPipeのポストトレーニング(学習済みモデルを追加で調整すること)の専門性、そしてオープンソースのmarimoノートブックプロジェクトです。狙いは、本番環境でのふるまいを次の学習に反映させることで、モデル、フレームワーク、クラウドをまたいでオープンであり続けるとしています。このうちARIAとSandboxesは一般提供されており、Agent Lensは新サービスです。

NVIDIAはさらに、サーバーレス(利用者が自分でサーバーを管理しなくてよい形態)の強化学習(試行錯誤を通じてAIを改善する学習手法)について説明しています。自己管理の構成と比べて、学習が1.4倍速く、コストが40%低いとしています。オープンソースの推論フレームワークNVIDIA Dynamoは、CoreWeaveのマネージド推論サービスと、プライベートプレビュー中のRL Rolloutsを支えています。NVIDIAによれば、Canva、Capital One、MasterClassがForge上で開発を行う最初期の企業です。

一般読者にとっての意味

このニュースのポイントは、次世代のAIハードウェアがクラウドの本番環境に入り始めたことです。AIコーディングアシスタントなどのエージェント型サービスは、大量の計算資源を必要とします。NVIDIAが述べるスループット向上が実際の利用でも成り立てば、エンドユーザーは応答の高速化や多段階推論の円滑化を実感できるかもしれません。NVIDIAは医療の例も挙げています。同社によると、15州にまたがり約50,000人のMedicare患者にサービスを提供するEnnoble Careが、CoreWeave上でRTX PRO 6000 GPUを使う予定です。用途は、臨床文書作成、意思決定支援、バックオフィス自動化のためのAIエージェントの拡大です。

  • 一般ユーザーが対応すべきことはありません。これはクラウドおよび企業レベルのインフラ更新です。
  • 開発者にとっては、隔離サンドボックスやポストトレーニングツールの一般提供により、AIエージェント構築のハードルが下がる可能性があります。ただし、判断は自身のテスト結果を基準にすべきです。
  • 性能数値はベンダーとパートナーによるものであり、今後独立した評価が出るかどうかが注目点です。

よくある質問

Vera Rubin NVL72とは何ですか?

NVIDIAブログによると、NVIDIAの次世代AIインフラシステムです。CoreWeaveが自社クラウドで、Spectrum-X 102.4Tイーサネットと組み合わせて提供すると発表しました。

4.8倍の性能向上は信頼できますか?

これはNVIDIAがCognitionの初期テストを引用した結果で、SWE-2推論ワークロードにおける「最大」の向上幅です。比較基準はGB200 NVL72で、第三者による検証結果は示されていません。

最初のユーザーは誰ですか?

NVIDIAブログによると、Devinを開発するCognitionが、Vera Rubin上で本番ワークロードを稼働させる初の顧客です。

Vera CPUは一般的なCPUと何が違いますか?

NVIDIAはVeraをAIエージェント向けに設計した初のCPUとしており、多数の隔離されたエージェント環境を同時に実行することに重点を置いています。CoreWeaveの導入では1ラックあたり11,264コアを備えます。

普段使っているAIサービスに影響はありますか?

間接的に影響する可能性があります。インフラの性能がNVIDIAの述べる通りに向上すれば、これらのクラウドサービスを採用するAIアプリの応答が速くなるかもしれません。ただし、実際の効果は各サービス事業者の導入状況によります。

このトピックの最新ニュースを見る

最新の旅の情報・ガイド

出典

ライフスタイル