生活分享

NVIDIA:CoreWeave 開始提供 Vera Rubin NVL72,Cognition 成首個生產客戶

NVIDIA 部落格指出,雲端業者 CoreWeave 宣布提供 NVIDIA 新一代 AI 運算系統 Vera Rubin NVL72,開發 AI 軟體工程師 Devin 的 Cognition 率先用於正式服務。CoreWeave 也將推出 Vera CPU,並發表 AI 模型與代理改進平台 CoreWeave Forge。這關係到 AI 服務背後的運算能力,本文整理重點,並說明對一般讀者的意義。

閱讀時間約 6 分鐘

NVIDIA:CoreWeave 開始提供 Vera Rubin NVL72,Cognition 成首個生產客戶
圖片:Mokaair (Original editorial artwork)

發生了什麼事

NVIDIA 部落格於 2026 年 9 月 30 日發文指出,雲端業者 CoreWeave 在本週於舊金山舉行的 CoreWeave Fully Connected 活動上,宣布提供 NVIDIA Vera Rubin NVL72 系統,並搭配 Spectrum-X 102.4T 乙太網路(一種資料中心網路技術)。NVIDIA 表示,CoreWeave 是最早將該平台交到客戶手上的雲端供應商之一。

據 NVIDIA 部落格,Cognition 是開發 AI 軟體工程師 Devin 的應用 AI 實驗室,也是首個在 Vera Rubin 上運行生產工作負載的客戶。生產工作負載指的是正式對外提供服務的運算工作,而非測試用途。NVIDIA 稱,CoreWeave 於本月稍早收到首批 Vera Rubin NVL72 生產機櫃,並在數天內為 Cognition 建立了生產用叢集。叢集是由多台機器組成、協同運作的運算群。

NVIDIA:CoreWeave 開始提供 Vera Rubin NVL72,Cognition 成首個生產客戶
Mokaair 編輯查核流程 · 圖片:Mokaair (Original editorial artwork)
閱讀完整文字說明

消息會先蒐集來源、獨立查核,再交由 Jev 判斷。

此外,NVIDIA 表示 CoreWeave 也將提供 NVIDIA Vera CPU,並推出 CoreWeave Forge。Forge 是一個整合環境,可以在 NVIDIA 加速運算上訓練、評估與改進 AI 模型及 AI 代理;AI 代理指能自行執行多步驟任務的 AI 程式。NVIDIA 副總裁 Ian Buck 另指出,V100 GPU 所屬的 Volta 架構推出已近十年,CoreWeave 的 V100 GPU 至今仍在執行客戶工作負載。

NVIDIA 公布的效能數據

據 NVIDIA 部落格,Cognition 以 GB200 NVL72 為比較基準,使用真實的軟體工程工作負載進行測試:先從 FrontierCode 抽樣任務,再讓 AI 代理解題。早期測試顯示,在 SWE-2 推論工作負載上,Vera Rubin NVL72 的總 token 吞吐量最高提升 4.8 倍。Cognition 創始團隊成員 Silas Alberti 表示,代理式程式開發涉及長上下文、高並行與大量 token。長上下文指一次要處理很長的內容,高並行指同時處理許多請求。他說,每個 token 的成本決定了他們能推出什麼。

在 CPU 方面,NVIDIA 稱 CoreWeave 的 Vera 部署在單一機櫃中放入 128 顆 CPU、共 11,264 個核心。若每個環境使用一個核心,可支撐超過 11,000 個同時運作的環境。CoreWeave 在測試中發現,代理沙箱的啟動速度提升超過 3 倍;沙箱是與其他系統隔離、讓程式安全執行的環境。此外,在 Terminal-Bench 評測的所有通過任務上,效能提升 1.7 倍。

CoreWeave 相關新服務與 NVIDIA 公布數據整理(資料來源:NVIDIA 部落格)
項目NVIDIA 部落格所述內容狀態
Vera Rubin NVL72相較 GB200 NVL72,SWE-2 推論總 token 吞吐量最高 4.8 倍(Cognition 早期測試)CoreWeave Cloud 已宣布提供
NVIDIA Vera CPU單機櫃 128 顆 CPU、11,264 核心;沙箱啟動快 3 倍以上將登上 CoreWeave Cloud
CoreWeave ARIA協助分析實驗、提出實驗與程式修改正式提供
CoreWeave Sandboxes在隔離的 CPU 或 GPU 環境執行代理、強化學習與評估正式提供
CoreWeave Agent Lens故障偵測提升 20%,修復成本減半(官方說法)新服務
RL Rollouts在服務運行中載入新的模型檢查點,無需重新部署私人預覽

CoreWeave Forge 是什麼

據 NVIDIA 部落格,CoreWeave Forge 整合了三個部分:Weights & Biases、OpenPipe 的後訓練專業能力,以及開源的 marimo 筆記本專案。後訓練是指在模型初步訓練完成後,進一步調整、提升其表現。Forge 的目標是讓 AI 在正式服務中的表現回饋到下一輪訓練,並保持跨模型、框架與雲端的開放性。其中 ARIA 與 Sandboxes 已正式提供,Agent Lens 為新服務。

NVIDIA 另稱,無伺服器強化學習比自行管理的設定訓練速度快 1.4 倍、成本低 40%。無伺服器指使用者不必自行管理伺服器;強化學習(RL)是讓模型從回饋中反覆學習的訓練方式。開源推論框架 NVIDIA Dynamo 則為 CoreWeave 的託管推論服務提供支援,也支援處於私人預覽階段的 RL Rollouts,後者可在服務運行中載入新的模型檢查點(訓練過程中儲存的模型版本)。據 NVIDIA,Canva、Capital One 與 MasterClass 是最早在 Forge 上開發的公司之一。

對一般讀者的意義

這則消息的重點在於,新一代 AI 硬體已開始進入雲端的正式服務環境。AI 程式助理等代理式服務需要大量運算;若 NVIDIA 所述的吞吐量提升在實際使用中成立,終端使用者可能感受到回應更快、多步驟推理更流暢。NVIDIA 也舉醫療為例:據其說法,居家照護業者 Ennoble Care 服務約 50,000 名需求較高的美國 Medicare(聯邦醫療保險)病患,範圍橫跨 15 州。該公司將在 CoreWeave 上使用 RTX PRO 6000 GPU,擴展用於臨床文件、決策支援與後勤自動化的 AI 代理。

  • 一般使用者無需採取任何行動,這是雲端與企業層級的基礎設施更新。
  • 對開發者而言,隔離沙箱與後訓練工具正式推出,可能降低打造 AI 代理的門檻,但仍應以自身測試為準。
  • 效能數字來自廠商與合作夥伴,後續是否有獨立評測值得關注。

常見問題

Vera Rubin NVL72 是什麼?

根據 NVIDIA 部落格,這是 NVIDIA 的新一代 AI 基礎設施系統,CoreWeave 宣布在其雲端提供,並搭配 Spectrum-X 102.4T 乙太網路。

4.8 倍效能提升可信嗎?

這是 NVIDIA 引述 Cognition 早期測試的結果,指的是在 SWE-2 推論工作負載上「最高」的提升幅度,比較基準為 GB200 NVL72,尚未有獨立驗證。

誰是第一個使用者?

據 NVIDIA 部落格,開發 Devin 的 Cognition 是首個在 Vera Rubin 上運行生產工作負載的客戶。

Vera CPU 和一般 CPU 有何不同?

NVIDIA 稱 Vera 是首款為 AI 代理打造的 CPU,重點在於同時運行大量彼此隔離的代理環境;CoreWeave 的部署單一機櫃有 11,264 個核心。

這會影響我日常使用的 AI 服務嗎?

可能會間接受到影響。若基礎設施效能提升如 NVIDIA 所述,採用這些雲端服務的 AI 應用可能回應更快,但實際效果取決於各服務商的部署。

查看同分類最新消息

最新旅遊情報攻略

資料來源

生活分享