生活分享
NVIDIA:CoreWeave 開始提供 Vera Rubin NVL72,Cognition 成首個生產客戶
NVIDIA 部落格指出,雲端業者 CoreWeave 宣布提供 NVIDIA 新一代 AI 運算系統 Vera Rubin NVL72,開發 AI 軟體工程師 Devin 的 Cognition 率先用於正式服務。CoreWeave 也將推出 Vera CPU,並發表 AI 模型與代理改進平台 CoreWeave Forge。這關係到 AI 服務背後的運算能力,本文整理重點,並說明對一般讀者的意義。
閱讀時間約 6 分鐘

發生了什麼事
NVIDIA 部落格於 2026 年 9 月 30 日發文指出,雲端業者 CoreWeave 在本週於舊金山舉行的 CoreWeave Fully Connected 活動上,宣布提供 NVIDIA Vera Rubin NVL72 系統,並搭配 Spectrum-X 102.4T 乙太網路(一種資料中心網路技術)。NVIDIA 表示,CoreWeave 是最早將該平台交到客戶手上的雲端供應商之一。
據 NVIDIA 部落格,Cognition 是開發 AI 軟體工程師 Devin 的應用 AI 實驗室,也是首個在 Vera Rubin 上運行生產工作負載的客戶。生產工作負載指的是正式對外提供服務的運算工作,而非測試用途。NVIDIA 稱,CoreWeave 於本月稍早收到首批 Vera Rubin NVL72 生產機櫃,並在數天內為 Cognition 建立了生產用叢集。叢集是由多台機器組成、協同運作的運算群。
閱讀完整文字說明
消息會先蒐集來源、獨立查核,再交由 Jev 判斷。
此外,NVIDIA 表示 CoreWeave 也將提供 NVIDIA Vera CPU,並推出 CoreWeave Forge。Forge 是一個整合環境,可以在 NVIDIA 加速運算上訓練、評估與改進 AI 模型及 AI 代理;AI 代理指能自行執行多步驟任務的 AI 程式。NVIDIA 副總裁 Ian Buck 另指出,V100 GPU 所屬的 Volta 架構推出已近十年,CoreWeave 的 V100 GPU 至今仍在執行客戶工作負載。
NVIDIA 公布的效能數據
據 NVIDIA 部落格,Cognition 以 GB200 NVL72 為比較基準,使用真實的軟體工程工作負載進行測試:先從 FrontierCode 抽樣任務,再讓 AI 代理解題。早期測試顯示,在 SWE-2 推論工作負載上,Vera Rubin NVL72 的總 token 吞吐量最高提升 4.8 倍。Cognition 創始團隊成員 Silas Alberti 表示,代理式程式開發涉及長上下文、高並行與大量 token。長上下文指一次要處理很長的內容,高並行指同時處理許多請求。他說,每個 token 的成本決定了他們能推出什麼。
在 CPU 方面,NVIDIA 稱 CoreWeave 的 Vera 部署在單一機櫃中放入 128 顆 CPU、共 11,264 個核心。若每個環境使用一個核心,可支撐超過 11,000 個同時運作的環境。CoreWeave 在測試中發現,代理沙箱的啟動速度提升超過 3 倍;沙箱是與其他系統隔離、讓程式安全執行的環境。此外,在 Terminal-Bench 評測的所有通過任務上,效能提升 1.7 倍。
| 項目 | NVIDIA 部落格所述內容 | 狀態 |
|---|---|---|
| Vera Rubin NVL72 | 相較 GB200 NVL72,SWE-2 推論總 token 吞吐量最高 4.8 倍(Cognition 早期測試) | CoreWeave Cloud 已宣布提供 |
| NVIDIA Vera CPU | 單機櫃 128 顆 CPU、11,264 核心;沙箱啟動快 3 倍以上 | 將登上 CoreWeave Cloud |
| CoreWeave ARIA | 協助分析實驗、提出實驗與程式修改 | 正式提供 |
| CoreWeave Sandboxes | 在隔離的 CPU 或 GPU 環境執行代理、強化學習與評估 | 正式提供 |
| CoreWeave Agent Lens | 故障偵測提升 20%,修復成本減半(官方說法) | 新服務 |
| RL Rollouts | 在服務運行中載入新的模型檢查點,無需重新部署 | 私人預覽 |
CoreWeave Forge 是什麼
據 NVIDIA 部落格,CoreWeave Forge 整合了三個部分:Weights & Biases、OpenPipe 的後訓練專業能力,以及開源的 marimo 筆記本專案。後訓練是指在模型初步訓練完成後,進一步調整、提升其表現。Forge 的目標是讓 AI 在正式服務中的表現回饋到下一輪訓練,並保持跨模型、框架與雲端的開放性。其中 ARIA 與 Sandboxes 已正式提供,Agent Lens 為新服務。
NVIDIA 另稱,無伺服器強化學習比自行管理的設定訓練速度快 1.4 倍、成本低 40%。無伺服器指使用者不必自行管理伺服器;強化學習(RL)是讓模型從回饋中反覆學習的訓練方式。開源推論框架 NVIDIA Dynamo 則為 CoreWeave 的託管推論服務提供支援,也支援處於私人預覽階段的 RL Rollouts,後者可在服務運行中載入新的模型檢查點(訓練過程中儲存的模型版本)。據 NVIDIA,Canva、Capital One 與 MasterClass 是最早在 Forge 上開發的公司之一。
對一般讀者的意義
這則消息的重點在於,新一代 AI 硬體已開始進入雲端的正式服務環境。AI 程式助理等代理式服務需要大量運算;若 NVIDIA 所述的吞吐量提升在實際使用中成立,終端使用者可能感受到回應更快、多步驟推理更流暢。NVIDIA 也舉醫療為例:據其說法,居家照護業者 Ennoble Care 服務約 50,000 名需求較高的美國 Medicare(聯邦醫療保險)病患,範圍橫跨 15 州。該公司將在 CoreWeave 上使用 RTX PRO 6000 GPU,擴展用於臨床文件、決策支援與後勤自動化的 AI 代理。
- 一般使用者無需採取任何行動,這是雲端與企業層級的基礎設施更新。
- 對開發者而言,隔離沙箱與後訓練工具正式推出,可能降低打造 AI 代理的門檻,但仍應以自身測試為準。
- 效能數字來自廠商與合作夥伴,後續是否有獨立評測值得關注。
常見問題
Vera Rubin NVL72 是什麼?
根據 NVIDIA 部落格,這是 NVIDIA 的新一代 AI 基礎設施系統,CoreWeave 宣布在其雲端提供,並搭配 Spectrum-X 102.4T 乙太網路。
4.8 倍效能提升可信嗎?
這是 NVIDIA 引述 Cognition 早期測試的結果,指的是在 SWE-2 推論工作負載上「最高」的提升幅度,比較基準為 GB200 NVL72,尚未有獨立驗證。
誰是第一個使用者?
據 NVIDIA 部落格,開發 Devin 的 Cognition 是首個在 Vera Rubin 上運行生產工作負載的客戶。
Vera CPU 和一般 CPU 有何不同?
NVIDIA 稱 Vera 是首款為 AI 代理打造的 CPU,重點在於同時運行大量彼此隔離的代理環境;CoreWeave 的部署單一機櫃有 11,264 個核心。
這會影響我日常使用的 AI 服務嗎?
可能會間接受到影響。若基礎設施效能提升如 NVIDIA 所述,採用這些雲端服務的 AI 應用可能回應更快,但實際效果取決於各服務商的部署。
同主題延伸閱讀
生活分享
Cloudflare 開源 Streamline:示範如何用其雲端服務為直播加圖、為影片燒入字幕
Cloudflare 於 2026 年 10 月 2 日推出並開源開發者實驗平台 Streamline,示範開發者如何結合 Stream、Workers、Containers 與 Durable Objects,自行打造影片處理流程,例如為直播即時加上圖示、為影片加上字幕。本文說明它是什麼、如何運作、有哪些限制,以及對觀眾與開發者的意義。
生活分享
Google 發布 Gemini 4 Argon:先交網路防禦者試用,一般用戶仍要等
Google 於 2026 年 9 月 30 日宣布新一代 AI 模型 Gemini 4 Argon,目前只透過 Fairwind Program 開放給受信任的網路安全防禦單位,一般用戶與開發者仍須等待。以下整理 Google 公布的能力、價格、安全措施,以及對一般讀者的影響;所有數據均為 Google 自述。
生活分享
Google Cloud 推出 Spanner Omni 正式版:企業可在自家機房與其他雲端執行 Spanner 資料庫
Google Cloud 宣布 Spanner Omni 正式推出(GA)。這個版本讓企業與開發者不必使用 Google Cloud,也能在自家資料中心、其他雲端或筆電上執行 Spanner 分散式資料庫。代價是維運責任落在客戶身上,Google 也不提供可用性保證。本文整理 Google Cloud 公布的功能、授權方式,以及它和全託管版的差異。
生活分享
Google Cloud 推出 CLI 遠端 MCP 伺服器預覽:讓 AI 代理直接執行 gcloud 與 bq 指令
Google Cloud 宣布 Google Cloud CLI 遠端 MCP 伺服器進入公開預覽,讓相容 MCP 的 AI 代理在雲端隔離沙箱中執行 gcloud 與 bq 指令。本文整理其運作方式、Google 所稱的安全機制、收費說明與對一般讀者的影響。
最新旅遊情報攻略

情報
2026 韓國楓葉預測:雪嶽山 10 月 20 日、首爾近郊 10 月底、內藏山與漢拏山 11 月上旬
韓國山林廳 2026 年 9 月 22 日公布的楓紅高峰預測:雪嶽山 10 月 20 日,春川、國立樹木園到首爾植物園落在 10 月 28 日到 11 月 2 日,內藏山 11 月 4 日、漢拏山 11 月 6 日,整體比最近 5 年晚約 0.8 天。整理各地楓樹與銀杏的預測日、首爾出發怎麼排,以及出發前去哪裡看即時楓況。2026 年 10 月查證。
- 季節活動
- 自然
- 觀景

攻略胡志明市
胡志明市到頭頓一日遊:白藤碼頭搭高速船、船票與班次,下船就是胡梅纜車與耶穌基督像
人在胡志明市挪一天去頭頓看海:市中心的白藤高速船碼頭搭船,航程 120 分鐘到頭頓的胡梅碼頭,平日成人 320,000 越南盾、週末 350,000,回程末班平日 15:00。下船就是胡梅纜車站,同一條路上有白宮,小山頂上是耶穌基督像。平日一天只有兩班船,整天要從末班船倒推著排。
- 交通
- 行程範例
- 海灘

攻略沖繩
沖繩不開車攻略:單軌只到浦添,美麗海水族館要坐兩個多小時的巴士,回那霸的最後一班直達車 17:22 就開走
不租車的沖繩怎麼移動:那霸市區靠沖繩都市單軌電車(ゆいレール),那霸機場站到終點てだこ浦西 19 站、17 公里、37 分鐘,一日券 1,000 日圓;美麗海水族館有那霸機場直達的高速巴士,單程 2,000 日圓起、官方時刻表上 2 小時上下,下車後還要走 10 分鐘;古宇利島要在今帰仁村役場轉車,當天來回光坐車就六個半小時;回程的最後一班直達車 17:22 就從記念公園前開走(2026 年 9 月查證)。
- 交通
- 行程範例
- 預算