生活分享

NVIDIA AI Infra Summit 談電力效率:Vera Rubin 與 DSX 新增了什麼

2026 年 9 月 15 日,NVIDIA 在加州聖塔克拉拉的 AI Infra Summit 上介紹 Vera Rubin 平台與 DSX 機房電力管理軟體,並表示衡量 AI 基礎設施的指標正從尖峰效能轉向每百萬瓦的 token 產出。本文依 NVIDIA 當天發布的官方部落格與 1 月、8 月的新聞稿查核,說明這天新增了什麼、哪些數字是實測、哪些官方自己標成投影,並整理官方還沒有說明的部分。

閱讀時間約 11 分鐘

原創插圖:由左到右依序是一顆晶片、一座裝著四層設備的機櫃、一棟排著九扇窗的機房,三者以箭頭相連;機房再以一條兩端有圓點的虛線連到最右邊的輸電鐵塔,代表晶片、機櫃、機房與電網四個層級
圖片:Mokaair (© Mokaair)

2026 年 9 月 15 日,依 NVIDIA 官方部落格當天刊出的彙整文章,NVIDIA 副總裁 Ian Buck 在美國加州聖塔克拉拉會議中心舉行的 AI Infra Summit 上,以 AI 機房效率為題發表基礎設施主題演講。

本文於 2026 年 9 月 17 日查核,讀的是 NVIDIA 當天發布的兩篇官方部落格全文,以及 1 月 5 日、8 月 24 日兩則官方新聞稿作為對照基準線。本站沒有做任何實測,也不提供採購或升級建議;下文數字皆標明是 NVIDIA 自己測到的、自己投影的,或官方轉述第三方測試機構的結果。

9 月 15 日發生了什麼:從尖峰效能到每百萬瓦的 token

NVIDIA 在這篇彙整文章裡表示,衡量 AI 基礎設施的方式正快速從尖峰效能轉向經驗證的代理式(agentic)每百萬瓦 token 數,AI 機房須從晶片到電網整體協同設計;這句話把 9 月 15 日和 1 月的 CES 發表分開來——1 月談晶片規格與每個 token 的成本,9 月談機房整體能從每百萬瓦電力擠出多少產出。

兩篇 9 月 15 日公告裡沒有新的晶片發表,NVIDIA 列出的是生態系合作與夥伴實測:NVIDIA 表示 Amazon 旗下 Annapurna Labs 正與它合作開發 NVHBM 客製高頻寬記憶體技術;d-Matrix 正整合 NVLink Fusion,讓 Vera CPU 與自家 Raptor XPU 搭配做大規模的超低延遲推論;Pinterest 採用 Blackwell 平台與 Dynamo 推論軟體,把對話式 AI 帶進視覺探索。這三項官方各只給一句話,沒有規格或時程;同一篇公告另有多家新創的 Vera CPU 測試結果與一段 NVLink 6 可靠度說明。

跟 1 月比,換了什麼:晶片沒變,量測的指標變了

1 月 5 日,NVIDIA 在 CES 發表 Rubin 平台,稱之為六顆新晶片(Vera CPU、Rubin GPU 等)。頭條數字是效能面:比 Blackwell 平台最高省 10 倍推論每 token 成本、訓練混合專家模型最高少用 4 倍 GPU,新聞稿用未來式寫相關產品預計 2026 年下半年由夥伴提供。8 月 24 日 Hot Chips 大會,NVIDIA 宣布 Groq 3 LPX 全面量產,稱平台橫跨七顆晶片、五款專用機櫃;商標聲明只寫 Groq 與 LPU 名稱經 Groq, Inc. 授權使用,查核到的官方文件沒有併購或收購 Groq 的說法。

到了 9 月 15 日,兩篇官方部落格都沒有再出現新的晶片名稱;1 月的新聞稿整篇沒有用百萬瓦當衡量單位,9 月 15 日的兩篇則反覆以每百萬瓦能產出多少 token 描述成果。換句話說,9 月 15 日新增的不是硬體,而是把 DSX 電力管理軟體推到第一批夥伴實測與商用示範的階段。

依 NVIDIA 於 2026 年 1 月 5 日、8 月 24 日、9 月 15 日與 9 月 16 日發布的公告整理,查核日 2026 年 9 月 17 日。
時間點官方說的主體官方給的數字與條件
2026-01-05CES:Rubin 六晶片平台發表官方稱比 Blackwell 平台最高省 10 倍每 token 推論成本、少 4 倍訓練 GPU
2026-08-24Hot Chips:Groq 3 LPX 宣布量產官方稱平台合計七顆晶片、五款機櫃;Groq、LPU 名稱授權自 Groq, Inc.
2026-09-15AI Infra Summit:DSX 電力軟體與夥伴實測官方稱 Lambda 測到吞吐量多 24%;Vera Rubin 的 40% 是官方投影
2026-09-16同一篇公告追加 MLPerf v6.1 預覽結果官方稱 Vera Rubin NVL72 吞吐量最高是 GB300 NVL72 的 3.7 倍

電力為什麼是瓶頸:DSX MaxLPS 與 DSX Flex 在做什麼

NVIDIA 引創辦人暨執行長黃仁勳的話解釋電力為何是瓶頸:一座十億瓦的機房永遠不會變成一座二十億瓦的機房;NVIDIA 在同一篇裡寫電力就是 AI 機房經濟裡的限制條件。DSX 軟體不是 9 月 15 日才推出,官方寫 DSX 是 5 月在 GTC Taipei(NVIDIA 在台灣的活動)發表的,沒有寫年份;兩篇 9 月 15 日公告都沒有再提到台灣的部署、夥伴或供應鏈,本文不替官方延伸。

DSX MaxLPS 處理機房內部電力調度:NVIDIA 表示在廠級,MaxLPS 會隨需求動態調度機櫃間電力,在同一場地電力額度內最高多出 40% 的 GPU,且不必新建輸電線路就最高多出 35% 的 token 吞吐量;機櫃層級另有削峰軟體與擴充儲能吸收短暫尖峰,官方在這一層沒有給百分比。這組電力數字裡有夥伴實測的是 Lambda:19 個節點在 85% 電力政策下跑在原本 16 個滿載節點的電力預算內,NVIDIA 稱叢集吞吐量多 24%、每瓦效能多 23%,但測的是 Blackwell 世代 HGX B200 伺服器,不是 Vera Rubin,Lambda 雲端服務總裁稱這是概念驗證。上面那個 40% 掛到 Vera Rubin NVL72 時,配套那篇官方文章標明它依 NVIDIA 自己的投影、限於合適的部署環境,同篇數字表還寫明要搭配機房電力規劃,不是量測結果。

DSX Flex 處理機房與電網之間的溝通:接收降載請求、需量反應事件與電價訊號,在預設工作優先順序內自動反應,讓最重要工作持續運作、其餘暫停後再恢復。NVIDIA 舉的例子是自家 Eos 機房參與矽谷電力公司彈性負載互聯方案,搭配 Emerald AI 的 Conductor:內文寫某個 8 月夜晚電力自動從 4 百萬瓦降到 3 百萬瓦,同頁一張照片說明也寫同樣兩個數字;但同文數字一覽表卻把同一場示範寫成一分鐘內降低 40% 的電力需求,NVIDIA 未說明兩者關係。官方稱之後已送出超過兩百次需求訊號、每次都成功,但這場示範還不是正式的 DSX Flex 安裝,只是證明概念可行。

四格圖解:晶片、機櫃、機房、電網四個層級的電力與效率調度
依 NVIDIA 2026 年 9 月 15 日發布的兩篇部落格文章整理,查核日 2026 年 9 月 17 日。 · 圖片:Mokaair (© Mokaair)

怎麼讀 NVIDIA 給的數字:哪些是實測、哪些是投影

接上 Groq 3 LPX 後,NVIDIA 的頭條數字是:對兩兆參數以上、長上下文模型,合併平台每百萬瓦 token 吞吐量最高是 GB200 NVL72 的 35 倍;較具體的是 Groq 3 LPX 在 10 萬 token 上下文的 Qwen 3.8 27B 負載下,每位使用者每秒測到 2,529 個輸出 token,兩者都帶著比較基準,拿掉條件單獨引用會失真。NVIDIA 也轉述第三方機構 SemiAnalysis 用 AgentX 方法量到的結果:DeepSeek V4 Pro 模型上,Vera Rubin NVL72 相對 GB300 NVL72 每百萬瓦吞吐量最高 30 倍,這是 NVIDIA 轉述別家機構的測試,本站未取得原始數據。

對供貨狀態,兩篇 9 月 15 日部落格給的只有一句:Vera Rubin 已全面生產,並持續在生態系中擴大部署,效能會隨軟體最佳化改善,沒有出貨數量、客戶名單或雲端地區清單。這篇部落格是持續更新的動態文章:它在 9 月 16 日(活動隔天)新增一段 MLPerf Inference v6.1 結果,NVIDIA 稱這是 Vera Rubin NVL72 首次 MLPerf 預覽提交,吞吐量最高是 GB300 NVL72 的 3.7 倍;這段內容屬於 9 月 16 日,不是 9 月 15 日當天發生的事。

對用雲端服務的人代表什麼、以及官方沒說什麼

以上數字量的都是機房層級指標:每百萬瓦 token 產出、每瓦效能、同電力額度下能放多少 GPU,沒有一項是對終端雲端服務速度、費率或供貨時間的承諾。硬體效率會不會反映到訂閱月費,先前 CES 報導已拆解過推論成本與終端定價的落差,這裡不重複;兩篇 9 月 15 日公告通篇沒有提到 Vera Rubin、Groq 3 LPX 或 DSX 任何一項的售價或授權費,只在描述電網訊號時出現過電價。

兩篇公告以 Taiwan 與 TSMC 查核到 2026 年 9 月 17 日都未見,沒有台灣部署、台灣夥伴或供應鏈的說明;與台灣有關的只有前一節提到 DSX 是在 GTC Taipei 發表的。想自己確認現況,可回到這兩篇部落格本身——高峰會那篇的最後更新時間在查核期間又往後移動過。讀者之後若看到更新版本,應以官方頁面當時內容為準。

常見問題

這場 AI Infra Summit 有發表新晶片嗎?

沒有。Vera Rubin 平台是 2026 年 1 月 5 日發表,Groq 3 LPX 是 8 月 24 日宣布量產;9 月 15 日這天,NVIDIA 官方部落格談的是電力管理軟體、夥伴的第一批實測數字,以及多家新創在 Vera CPU 上跑出來的測試結果,本文查核到的兩篇公告裡都沒有出現新的晶片名稱。

DSX MaxLPS 讓 Vera Rubin 機房多出 40% 的 GPU,這是量測出來的結果嗎?

不是。這個 40% 指的是在同一電力預算內多放 40% 的 GPU,而在《從百萬瓦到 token》那篇官方文章裡,NVIDIA 標明它是依 NVIDIA 自己的投影、限於合適的部署環境,同篇的數字一覽表還寫明那是 MaxLPS 搭配機房電力規劃的結果;同一件事在同日的高峰會彙整文裡沒有標上投影兩個字。這兩篇裡有量測數字的是 Lambda 的測試,吞吐量多 24%、每瓦效能多 23%,用的是 Blackwell 世代的 HGX B200 伺服器,不是 Vera Rubin,Lambda 雲端服務總裁自己把這稱為概念驗證。

矽谷電力公司那場降載示範,電力到底降了多少?

NVIDIA 在同一篇公告裡用了兩種說法:內文與同頁一張照片說明都寫電力自動從 4 百萬瓦降到 3 百萬瓦,另一份數字一覽表格把同一場示範寫成一分鐘內降低 40% 的電力需求。官方沒有自己說明這兩個數字之間的關係,本文把兩個數字都列出來,不替官方選一個當作唯一答案。

這件事跟台灣有關係嗎?

本文查核的兩篇 9 月 15 日公告裡,沒有出現台灣或台積電。唯一的關聯是,DSX 這套電力管理軟體本身是 5 月在 GTC Taipei(NVIDIA 在台灣舉辦的活動)發表的,但公告沒有進一步說明任何台灣的部署、夥伴或供應鏈細節,本文也不替官方補上。

Vera Rubin 現在買得到嗎、多少錢?

官方說法是已進入全面生產,並持續在生態系中擴大部署,但沒有公布出貨數量、客戶名單或雲端地區清單;1 月的新聞稿寫夥伴產品預計 2026 年下半年提供,9 月 15 日的材料沒有更新這個時程。本文查核到的兩篇 9 月 15 日公告都沒有寫出 Vera Rubin、Groq 3 LPX 或 DSX 任何一項的售價或授權費,本文也不做應不應該採用的建議。

SemiAnalysis 說的 30 倍是什麼意思?

那是 NVIDIA 轉述第三方測試機構 SemiAnalysis 用 AgentX 方法量到的結果:在 DeepSeek V4 Pro 模型上,Vera Rubin NVL72 相對 GB300 NVL72 每百萬瓦吞吐量最高 30 倍。這是 NVIDIA 引用別家機構的測試,本站沒有取得 SemiAnalysis 的原始數據,只能記錄 NVIDIA 是怎麼引用的。

最新旅遊情報攻略

資料來源

生活分享