生活分享
NVIDIA AI Infra Summit 談電力效率:Vera Rubin 與 DSX 新增了什麼
2026 年 9 月 15 日,NVIDIA 在加州聖塔克拉拉的 AI Infra Summit 上介紹 Vera Rubin 平台與 DSX 機房電力管理軟體,並表示衡量 AI 基礎設施的指標正從尖峰效能轉向每百萬瓦的 token 產出。本文依 NVIDIA 當天發布的官方部落格與 1 月、8 月的新聞稿查核,說明這天新增了什麼、哪些數字是實測、哪些官方自己標成投影,並整理官方還沒有說明的部分。
閱讀時間約 11 分鐘

2026 年 9 月 15 日,依 NVIDIA 官方部落格當天刊出的彙整文章,NVIDIA 副總裁 Ian Buck 在美國加州聖塔克拉拉會議中心舉行的 AI Infra Summit 上,以 AI 機房效率為題發表基礎設施主題演講。
本文於 2026 年 9 月 17 日查核,讀的是 NVIDIA 當天發布的兩篇官方部落格全文,以及 1 月 5 日、8 月 24 日兩則官方新聞稿作為對照基準線。本站沒有做任何實測,也不提供採購或升級建議;下文數字皆標明是 NVIDIA 自己測到的、自己投影的,或官方轉述第三方測試機構的結果。
9 月 15 日發生了什麼:從尖峰效能到每百萬瓦的 token
NVIDIA 在這篇彙整文章裡表示,衡量 AI 基礎設施的方式正快速從尖峰效能轉向經驗證的代理式(agentic)每百萬瓦 token 數,AI 機房須從晶片到電網整體協同設計;這句話把 9 月 15 日和 1 月的 CES 發表分開來——1 月談晶片規格與每個 token 的成本,9 月談機房整體能從每百萬瓦電力擠出多少產出。
兩篇 9 月 15 日公告裡沒有新的晶片發表,NVIDIA 列出的是生態系合作與夥伴實測:NVIDIA 表示 Amazon 旗下 Annapurna Labs 正與它合作開發 NVHBM 客製高頻寬記憶體技術;d-Matrix 正整合 NVLink Fusion,讓 Vera CPU 與自家 Raptor XPU 搭配做大規模的超低延遲推論;Pinterest 採用 Blackwell 平台與 Dynamo 推論軟體,把對話式 AI 帶進視覺探索。這三項官方各只給一句話,沒有規格或時程;同一篇公告另有多家新創的 Vera CPU 測試結果與一段 NVLink 6 可靠度說明。
跟 1 月比,換了什麼:晶片沒變,量測的指標變了
1 月 5 日,NVIDIA 在 CES 發表 Rubin 平台,稱之為六顆新晶片(Vera CPU、Rubin GPU 等)。頭條數字是效能面:比 Blackwell 平台最高省 10 倍推論每 token 成本、訓練混合專家模型最高少用 4 倍 GPU,新聞稿用未來式寫相關產品預計 2026 年下半年由夥伴提供。8 月 24 日 Hot Chips 大會,NVIDIA 宣布 Groq 3 LPX 全面量產,稱平台橫跨七顆晶片、五款專用機櫃;商標聲明只寫 Groq 與 LPU 名稱經 Groq, Inc. 授權使用,查核到的官方文件沒有併購或收購 Groq 的說法。
到了 9 月 15 日,兩篇官方部落格都沒有再出現新的晶片名稱;1 月的新聞稿整篇沒有用百萬瓦當衡量單位,9 月 15 日的兩篇則反覆以每百萬瓦能產出多少 token 描述成果。換句話說,9 月 15 日新增的不是硬體,而是把 DSX 電力管理軟體推到第一批夥伴實測與商用示範的階段。
| 時間點 | 官方說的主體 | 官方給的數字與條件 |
|---|---|---|
| 2026-01-05 | CES:Rubin 六晶片平台發表 | 官方稱比 Blackwell 平台最高省 10 倍每 token 推論成本、少 4 倍訓練 GPU |
| 2026-08-24 | Hot Chips:Groq 3 LPX 宣布量產 | 官方稱平台合計七顆晶片、五款機櫃;Groq、LPU 名稱授權自 Groq, Inc. |
| 2026-09-15 | AI Infra Summit:DSX 電力軟體與夥伴實測 | 官方稱 Lambda 測到吞吐量多 24%;Vera Rubin 的 40% 是官方投影 |
| 2026-09-16 | 同一篇公告追加 MLPerf v6.1 預覽結果 | 官方稱 Vera Rubin NVL72 吞吐量最高是 GB300 NVL72 的 3.7 倍 |
電力為什麼是瓶頸:DSX MaxLPS 與 DSX Flex 在做什麼
NVIDIA 引創辦人暨執行長黃仁勳的話解釋電力為何是瓶頸:一座十億瓦的機房永遠不會變成一座二十億瓦的機房;NVIDIA 在同一篇裡寫電力就是 AI 機房經濟裡的限制條件。DSX 軟體不是 9 月 15 日才推出,官方寫 DSX 是 5 月在 GTC Taipei(NVIDIA 在台灣的活動)發表的,沒有寫年份;兩篇 9 月 15 日公告都沒有再提到台灣的部署、夥伴或供應鏈,本文不替官方延伸。
DSX MaxLPS 處理機房內部電力調度:NVIDIA 表示在廠級,MaxLPS 會隨需求動態調度機櫃間電力,在同一場地電力額度內最高多出 40% 的 GPU,且不必新建輸電線路就最高多出 35% 的 token 吞吐量;機櫃層級另有削峰軟體與擴充儲能吸收短暫尖峰,官方在這一層沒有給百分比。這組電力數字裡有夥伴實測的是 Lambda:19 個節點在 85% 電力政策下跑在原本 16 個滿載節點的電力預算內,NVIDIA 稱叢集吞吐量多 24%、每瓦效能多 23%,但測的是 Blackwell 世代 HGX B200 伺服器,不是 Vera Rubin,Lambda 雲端服務總裁稱這是概念驗證。上面那個 40% 掛到 Vera Rubin NVL72 時,配套那篇官方文章標明它依 NVIDIA 自己的投影、限於合適的部署環境,同篇數字表還寫明要搭配機房電力規劃,不是量測結果。
DSX Flex 處理機房與電網之間的溝通:接收降載請求、需量反應事件與電價訊號,在預設工作優先順序內自動反應,讓最重要工作持續運作、其餘暫停後再恢復。NVIDIA 舉的例子是自家 Eos 機房參與矽谷電力公司彈性負載互聯方案,搭配 Emerald AI 的 Conductor:內文寫某個 8 月夜晚電力自動從 4 百萬瓦降到 3 百萬瓦,同頁一張照片說明也寫同樣兩個數字;但同文數字一覽表卻把同一場示範寫成一分鐘內降低 40% 的電力需求,NVIDIA 未說明兩者關係。官方稱之後已送出超過兩百次需求訊號、每次都成功,但這場示範還不是正式的 DSX Flex 安裝,只是證明概念可行。
怎麼讀 NVIDIA 給的數字:哪些是實測、哪些是投影
接上 Groq 3 LPX 後,NVIDIA 的頭條數字是:對兩兆參數以上、長上下文模型,合併平台每百萬瓦 token 吞吐量最高是 GB200 NVL72 的 35 倍;較具體的是 Groq 3 LPX 在 10 萬 token 上下文的 Qwen 3.8 27B 負載下,每位使用者每秒測到 2,529 個輸出 token,兩者都帶著比較基準,拿掉條件單獨引用會失真。NVIDIA 也轉述第三方機構 SemiAnalysis 用 AgentX 方法量到的結果:DeepSeek V4 Pro 模型上,Vera Rubin NVL72 相對 GB300 NVL72 每百萬瓦吞吐量最高 30 倍,這是 NVIDIA 轉述別家機構的測試,本站未取得原始數據。
對供貨狀態,兩篇 9 月 15 日部落格給的只有一句:Vera Rubin 已全面生產,並持續在生態系中擴大部署,效能會隨軟體最佳化改善,沒有出貨數量、客戶名單或雲端地區清單。這篇部落格是持續更新的動態文章:它在 9 月 16 日(活動隔天)新增一段 MLPerf Inference v6.1 結果,NVIDIA 稱這是 Vera Rubin NVL72 首次 MLPerf 預覽提交,吞吐量最高是 GB300 NVL72 的 3.7 倍;這段內容屬於 9 月 16 日,不是 9 月 15 日當天發生的事。
對用雲端服務的人代表什麼、以及官方沒說什麼
以上數字量的都是機房層級指標:每百萬瓦 token 產出、每瓦效能、同電力額度下能放多少 GPU,沒有一項是對終端雲端服務速度、費率或供貨時間的承諾。硬體效率會不會反映到訂閱月費,先前 CES 報導已拆解過推論成本與終端定價的落差,這裡不重複;兩篇 9 月 15 日公告通篇沒有提到 Vera Rubin、Groq 3 LPX 或 DSX 任何一項的售價或授權費,只在描述電網訊號時出現過電價。
兩篇公告以 Taiwan 與 TSMC 查核到 2026 年 9 月 17 日都未見,沒有台灣部署、台灣夥伴或供應鏈的說明;與台灣有關的只有前一節提到 DSX 是在 GTC Taipei 發表的。想自己確認現況,可回到這兩篇部落格本身——高峰會那篇的最後更新時間在查核期間又往後移動過。讀者之後若看到更新版本,應以官方頁面當時內容為準。
常見問題
這場 AI Infra Summit 有發表新晶片嗎?
沒有。Vera Rubin 平台是 2026 年 1 月 5 日發表,Groq 3 LPX 是 8 月 24 日宣布量產;9 月 15 日這天,NVIDIA 官方部落格談的是電力管理軟體、夥伴的第一批實測數字,以及多家新創在 Vera CPU 上跑出來的測試結果,本文查核到的兩篇公告裡都沒有出現新的晶片名稱。
DSX MaxLPS 讓 Vera Rubin 機房多出 40% 的 GPU,這是量測出來的結果嗎?
不是。這個 40% 指的是在同一電力預算內多放 40% 的 GPU,而在《從百萬瓦到 token》那篇官方文章裡,NVIDIA 標明它是依 NVIDIA 自己的投影、限於合適的部署環境,同篇的數字一覽表還寫明那是 MaxLPS 搭配機房電力規劃的結果;同一件事在同日的高峰會彙整文裡沒有標上投影兩個字。這兩篇裡有量測數字的是 Lambda 的測試,吞吐量多 24%、每瓦效能多 23%,用的是 Blackwell 世代的 HGX B200 伺服器,不是 Vera Rubin,Lambda 雲端服務總裁自己把這稱為概念驗證。
矽谷電力公司那場降載示範,電力到底降了多少?
NVIDIA 在同一篇公告裡用了兩種說法:內文與同頁一張照片說明都寫電力自動從 4 百萬瓦降到 3 百萬瓦,另一份數字一覽表格把同一場示範寫成一分鐘內降低 40% 的電力需求。官方沒有自己說明這兩個數字之間的關係,本文把兩個數字都列出來,不替官方選一個當作唯一答案。
這件事跟台灣有關係嗎?
本文查核的兩篇 9 月 15 日公告裡,沒有出現台灣或台積電。唯一的關聯是,DSX 這套電力管理軟體本身是 5 月在 GTC Taipei(NVIDIA 在台灣舉辦的活動)發表的,但公告沒有進一步說明任何台灣的部署、夥伴或供應鏈細節,本文也不替官方補上。
Vera Rubin 現在買得到嗎、多少錢?
官方說法是已進入全面生產,並持續在生態系中擴大部署,但沒有公布出貨數量、客戶名單或雲端地區清單;1 月的新聞稿寫夥伴產品預計 2026 年下半年提供,9 月 15 日的材料沒有更新這個時程。本文查核到的兩篇 9 月 15 日公告都沒有寫出 Vera Rubin、Groq 3 LPX 或 DSX 任何一項的售價或授權費,本文也不做應不應該採用的建議。
SemiAnalysis 說的 30 倍是什麼意思?
那是 NVIDIA 轉述第三方測試機構 SemiAnalysis 用 AgentX 方法量到的結果:在 DeepSeek V4 Pro 模型上,Vera Rubin NVL72 相對 GB300 NVL72 每百萬瓦吞吐量最高 30 倍。這是 NVIDIA 引用別家機構的測試,本站沒有取得 SemiAnalysis 的原始數據,只能記錄 NVIDIA 是怎麼引用的。
2026 年科技新聞總整理:硬體、平台、電信與法規的重點2026 年科技新聞總整理:硬體、平台、電信與法規的重點整理本站 2026 年的科技新聞解析,分成硬體、平台、運算基礎設施、台灣政策與歐盟法規五組:iPhone Duo 與九月新機、Googlebook、M6 與 M5 Ultra、Snapdragon 8 Elite Gen 6、Project Zenith、Pixel Drop、App Store 訂閱新規則、WordPress 與 Synology 等資安更新、NVIDIA 三則公告、6G 頻譜研討會、臺馬海纜、主權 AI 語料庫、《網路韌性法》通報義務、KIDS Act 提案、Apple 歐盟 App 條款與追蹤透明度詢問框。不做購買建議,廠商宣稱一律歸因,每篇都附官方來源與查核日。閱讀全文
NVIDIA 為 CUDA-Q 開源平台新增 CUDA-Q Logical:估算容錯量子電腦規模,不是量子電腦本身NVIDIA 為 CUDA-Q 開源平台新增 CUDA-Q Logical:估算容錯量子電腦規模,不是量子電腦本身2026 年 9 月 14 日,NVIDIA 宣布為開源的 CUDA-Q 平台新增 CUDA-Q Logical,這是一個協調層,用來幫助研究者估算容錯量子運算應用程式需要多少硬體,而不是新的量子電腦。本文依 NVIDIA 新聞稿與技術文件,說明這個工具能做與不能做的事、新聞稿和技術文件用詞的落差,以及桑迪亞國家實驗室開發的跨平台基準 QUOPS。查核日 2026 年 9 月 17 日。閱讀全文
同主題延伸閱讀
生活分享
NVIDIA Rubin 在 CES 亮相:AI 算力升級會如何影響日常服務?
分析 NVIDIA Rubin 資料中心運算平台對日常雲端 AI 服務的實質影響,探討推論成本、佇列延遲與企業實際帳單之關聯。
生活分享
NVIDIA 為 CUDA-Q 開源平台新增 CUDA-Q Logical:估算容錯量子電腦規模,不是量子電腦本身
2026 年 9 月 14 日,NVIDIA 宣布為開源的 CUDA-Q 平台新增 CUDA-Q Logical,這是一個協調層,用來幫助研究者估算容錯量子運算應用程式需要多少硬體,而不是新的量子電腦。本文依 NVIDIA 新聞稿與技術文件,說明這個工具能做與不能做的事、新聞稿和技術文件用詞的落差,以及桑迪亞國家實驗室開發的跨平台基準 QUOPS。查核日 2026 年 9 月 17 日。
生活分享
NVIDIA 投資聯發科技 35 億美元:合作深化公告與可轉債申報書各寫了什麼
2026 年 8 月 31 日,NVIDIA 與聯發科技宣布深化在 AI 基礎建設、邊緣 AI 運算與車用三大領域的合作,NVIDIA 並投資 35 億美元於聯發科技發行的可轉換公司債。本文依官方新聞稿與聯發科技向公開資訊觀測站申報的定價公告,整理新聞稿寫了什麼、申報書另外揭露哪些發行條件,以及這幾份文件沒有交代的部分,查核日 2026 年 9 月 17 日。
生活分享
Cloudflare 推出 Traces 公開測試版:網站經營者可在一條時間軸看清請求經過平台的每一步
Cloudflare 於 2026 年 10 月 2 日宣布推出 Cloudflare Traces 公開測試版。使用 Cloudflare 的網站經營者與開發者,可在同一條時間軸上看到請求經過安全規則、快取、路由與來源伺服器的過程,方便找出請求被封鎖或變慢的原因。新的計價方式自 2026 年 12 月 1 日起生效。資訊出自 Cloudflare 官方部落格。
引用本文的文章
最新旅遊情報攻略

情報
2026 韓國楓葉預測:雪嶽山 10 月 20 日、首爾近郊 10 月底、內藏山與漢拏山 11 月上旬
韓國山林廳 2026 年 9 月 22 日公布的楓紅高峰預測:雪嶽山 10 月 20 日,春川、國立樹木園到首爾植物園落在 10 月 28 日到 11 月 2 日,內藏山 11 月 4 日、漢拏山 11 月 6 日,整體比最近 5 年晚約 0.8 天。整理各地楓樹與銀杏的預測日、首爾出發怎麼排,以及出發前去哪裡看即時楓況。2026 年 10 月查證。
- 季節活動
- 自然
- 觀景

攻略胡志明市
胡志明市到頭頓一日遊:白藤碼頭搭高速船、船票與班次,下船就是胡梅纜車與耶穌基督像
人在胡志明市挪一天去頭頓看海:市中心的白藤高速船碼頭搭船,航程 120 分鐘到頭頓的胡梅碼頭,平日成人 320,000 越南盾、週末 350,000,回程末班平日 15:00。下船就是胡梅纜車站,同一條路上有白宮,小山頂上是耶穌基督像。平日一天只有兩班船,整天要從末班船倒推著排。
- 交通
- 行程範例
- 海灘

攻略沖繩
沖繩不開車攻略:單軌只到浦添,美麗海水族館要坐兩個多小時的巴士,回那霸的最後一班直達車 17:22 就開走
不租車的沖繩怎麼移動:那霸市區靠沖繩都市單軌電車(ゆいレール),那霸機場站到終點てだこ浦西 19 站、17 公里、37 分鐘,一日券 1,000 日圓;美麗海水族館有那霸機場直達的高速巴士,單程 2,000 日圓起、官方時刻表上 2 小時上下,下車後還要走 10 分鐘;古宇利島要在今帰仁村役場轉車,當天來回光坐車就六個半小時;回程的最後一班直達車 17:22 就從記念公園前開走(2026 年 9 月查證)。
- 交通
- 行程範例
- 預算
資料來源
- AI Infra Summit: NVIDIA Vera Rubin and DSX Platform Advancements Showcase Energy Efficiencies of Optimizing Tokens Per Watt for AI Factories · 查證日期:
- From Megawatts to Tokens: How NVIDIA Maximizes AI Factory Production · 查證日期:
- NVIDIA Kicks Off the Next Generation of AI With Rubin — Six New Chips, One Incredible AI Supercomputer · 查證日期:
- NVIDIA Groq 3 LPX Now in Full Production With World-Class Speed for Agentic AI · 查證日期: