生活分享
NVIDIA AI Infra Summit 谈电力效率:Vera Rubin 与 DSX 新增了什么
2026 年 9 月 15 日,NVIDIA 在加州圣塔克拉拉的 AI Infra Summit 上介绍 Vera Rubin 平台与 DSX 机房电力管理软件,并表示衡量 AI 基础设施的指标正从峰值性能转向每兆瓦的 token 产出。本文依 NVIDIA 当天发布的官方博客与 1 月、8 月的新闻稿查核,说明这天新增了什么、哪些数字是实测、哪些官方自己标为投影,并整理官方尚未说明的部分。
阅读时间约 11 分钟

2026 年 9 月 15 日,据 NVIDIA 官方博客当天刊出的汇总文章,NVIDIA 副总裁 Ian Buck 在美国加州圣塔克拉拉会议中心举行的 AI Infra Summit 上,以 AI 机房效率为题发表基础设施主题演讲。
本文于 2026 年 9 月 17 日查核,读的是 NVIDIA 当天发布的两篇官方博客全文,以及 1 月 5 日、8 月 24 日两则官方新闻稿作为对照基准线。本站没有做任何实测,也不提供采购或升级建议;下文数字皆标明是 NVIDIA 自己测到的、自己投影的,或官方转述第三方测试机构的结果。
9 月 15 日发生了什么:从峰值性能到每兆瓦的 token
NVIDIA 在这篇汇总文章里表示,衡量 AI 基础设施的方式正快速从峰值性能转向经验证的代理式(agentic)每兆瓦 token 数,AI 机房须从芯片到电网整体协同设计;这句话把 9 月 15 日和 1 月的 CES 发布分开来——1 月谈芯片规格与每个 token 的成本,9 月谈机房整体能从每兆瓦电力挤出多少产出。
两篇 9 月 15 日公告里没有新的芯片发布,NVIDIA 列出的是生态系合作与合作伙伴实测:NVIDIA 表示 Amazon 旗下 Annapurna Labs 正与它合作开发 NVHBM 定制高带宽内存技术;d-Matrix 正整合 NVLink Fusion,让 Vera CPU 与自家 Raptor XPU 搭配做大规模的超低延迟推理;Pinterest 采用 Blackwell 平台与 Dynamo 推理软件,把对话式 AI 带进视觉探索。这三项官方各只给一句话,没有规格或时程;同一篇公告另有多家初创公司的 Vera CPU 测试结果与一段 NVLink 6 可靠性说明。
跟 1 月比,换了什么:芯片没变,测量的指标变了
1 月 5 日,NVIDIA 在 CES 发布 Rubin 平台,称之为六颗新芯片(Vera CPU、Rubin GPU 等)。头条数字是性能面:比 Blackwell 平台最高省 10 倍推理每 token 成本、训练混合专家模型最高少用 4 倍 GPU,新闻稿用未来式写相关产品预计 2026 年下半年由合作伙伴提供。8 月 24 日 Hot Chips 大会,NVIDIA 宣布 Groq 3 LPX 全面量产,称平台横跨七颗芯片、五款专用机柜;商标声明只写 Groq 与 LPU 名称经 Groq, Inc. 授权使用,查核到的官方文件没有并购或收购 Groq 的说法。
到了 9 月 15 日,两篇官方博客都没有再出现新的芯片名称;1 月的新闻稿整篇没有用兆瓦当衡量单位,9 月 15 日的两篇则反复以每兆瓦能产出多少 token 描述成果。换句话说,9 月 15 日新增的不是硬件,而是把 DSX 电力管理软件推到第一批合作伙伴实测与商用示范的阶段。
| 时间点 | 官方说的主体 | 官方给的数字与条件 |
|---|---|---|
| 2026-01-05 | CES:Rubin 六芯片平台发布 | 官方称比 Blackwell 平台最高省 10 倍每 token 推理成本、少 4 倍训练 GPU |
| 2026-08-24 | Hot Chips:Groq 3 LPX 宣布量产 | 官方称平台合计七颗芯片、五款机柜;Groq、LPU 名称授权自 Groq, Inc. |
| 2026-09-15 | AI Infra Summit:DSX 电力软件与合作伙伴实测 | 官方称 Lambda 测到吞吐量多 24%;Vera Rubin 的 40% 是官方投影 |
| 2026-09-16 | 同一篇公告追加 MLPerf v6.1 预览结果 | 官方称 Vera Rubin NVL72 吞吐量最高是 GB300 NVL72 的 3.7 倍 |
电力为什么是瓶颈:DSX MaxLPS 与 DSX Flex 在做什么
NVIDIA 引创始人兼首席执行官黄仁勋的话解释电力为何是瓶颈:一座 1 吉瓦(GW)的机房永远不会变成一座 2 吉瓦的机房;NVIDIA 在同一篇里写电力就是 AI 机房经济里的限制条件。DSX 软件不是 9 月 15 日才推出,官方写 DSX 是 5 月在 GTC Taipei(NVIDIA 在台湾的活动)发布的,没有写年份;两篇 9 月 15 日公告都没有再提到台湾的部署、合作伙伴或供应链,本文不替官方延伸。
DSX MaxLPS 处理机房内部的电力调度:NVIDIA 表示在 AI 工厂(AI factory,NVIDIA 对 AI 机房的称呼)这一层级,MaxLPS 会随需求动态调度机柜间电力,在同一场地电力额度内最高多出 40% 的 GPU,且不必新建输电线路就最高多出 35% 的 token 吞吐量;机柜层级另有削峰软件与扩充储能吸收短暂尖峰,官方在这一层没有给百分比。这组电力数字里有合作伙伴实测的是 Lambda:19 个节点在 85% 电力政策下跑在原本 16 个满载节点的电力预算内,NVIDIA 称集群吞吐量多 24%、每瓦性能多 23%,但测的是 Blackwell 世代 HGX B200 服务器,不是 Vera Rubin,Lambda 云服务总裁称这是概念验证。上面那个 40% 挂到 Vera Rubin NVL72 时,配套那篇官方文章标明它依 NVIDIA 自己的投影、限于合适的部署环境,同篇数字表还写明要搭配机房电力规划,不是测量结果。
DSX Flex 处理机房与电网之间的沟通:接收降载请求、需求响应事件与电价信号,在默认工作优先顺序内自动反应,让最重要的工作持续运行、其余暂停后再恢复。NVIDIA 举的例子是自家 Eos 机房参与硅谷电力公司弹性负载互联方案,搭配 Emerald AI 的 Conductor:正文写某个 8 月夜晚电力自动从 4 兆瓦降到 3 兆瓦,同页一张照片说明也写同样两个数字;但同文数字一览表却把同一场示范写成一分钟内降低 40% 的电力需求,NVIDIA 未说明两者关系。官方称之后已送出超过两百次需求信号、每次都成功,但这场示范还不是正式的 DSX Flex 安装,只是证明概念可行。
怎么读 NVIDIA 给的数字:哪些是实测、哪些是投影
接上 Groq 3 LPX 后,NVIDIA 的头条数字是:对两万亿参数以上、长上下文模型,合并平台每兆瓦 token 吞吐量最高是 GB200 NVL72 的 35 倍;较具体的是 Groq 3 LPX 在 10 万 token 上下文的 Qwen 3.8 27B 负载下,每位用户每秒测到 2,529 个输出 token,两者都带着比较基准,拿掉条件单独引用会失真。NVIDIA 也转述第三方机构 SemiAnalysis 用 AgentX 方法量到的结果:DeepSeek V4 Pro 模型上,Vera Rubin NVL72 相对 GB300 NVL72 每兆瓦吞吐量最高 30 倍,这是 NVIDIA 转述别家机构的测试,本站未取得原始数据。
对供货状态,两篇 9 月 15 日博客给的只有一句:Vera Rubin 已全面生产,并持续在生态系中扩大部署,性能会随软件优化改善,没有出货数量、客户名单或云端地区清单。这篇博客是持续更新的动态文章:它在 9 月 16 日(活动隔天)新增一段 MLPerf Inference v6.1 结果,NVIDIA 称这是 Vera Rubin NVL72 首次 MLPerf 预览提交,吞吐量最高是 GB300 NVL72 的 3.7 倍;这段内容属于 9 月 16 日,不是 9 月 15 日当天发生的事。
对用云端服务的人代表什么、以及官方没说什么
以上数字量的都是机房层级指标:每兆瓦 token 产出、每瓦性能、同电力额度下能放多少 GPU,没有一项是对终端云端服务速度、费率或供货时间的承诺。硬件效率会不会反映到订阅月费,先前 CES 报道已拆解过推理成本与终端定价的落差,这里不重复;两篇 9 月 15 日公告通篇没有提到 Vera Rubin、Groq 3 LPX 或 DSX 任何一项的售价或授权费,只在描述电网信号时出现过电价。
两篇公告以 Taiwan 与 TSMC 查核到 2026 年 9 月 17 日都未见,没有台湾部署、台湾合作伙伴或供应链的说明;与台湾有关的只有前一节提到 DSX 是在 GTC Taipei 发布的。想自己确认现况,可回到这两篇博客本身——峰会那篇的最后更新时间在查核期间又往后移动过。读者之后若看到更新版本,应以官方页面当时内容为准。
常见问题
这场 AI Infra Summit 有发布新芯片吗?
没有。Vera Rubin 平台是 2026 年 1 月 5 日发布,Groq 3 LPX 是 8 月 24 日宣布量产;9 月 15 日这天,NVIDIA 官方博客谈的是电力管理软件、合作伙伴的第一批实测数字,以及多家初创公司在 Vera CPU 上跑出来的测试结果,本文查核到的两篇公告里都没有出现新的芯片名称。
DSX MaxLPS 让 Vera Rubin 机房多出 40% 的 GPU,这是测量出来的结果吗?
不是。这个 40% 指的是在同一电力预算内多放 40% 的 GPU,而在《从兆瓦到 token》那篇官方文章里,NVIDIA 标明它是依 NVIDIA 自己的投影、限于合适的部署环境,同篇的数字一览表还写明那是 MaxLPS 搭配机房电力规划的结果;同一件事在同日的峰会汇总文里没有标上投影两个字。这两篇里有测量数字的是 Lambda 的测试,吞吐量多 24%、每瓦性能多 23%,用的是 Blackwell 世代的 HGX B200 服务器,不是 Vera Rubin,Lambda 云服务总裁自己把这称为概念验证。
硅谷电力公司那场降载示范,电力到底降了多少?
NVIDIA 在同一篇公告里用了两种说法:正文与同页一张照片说明都写电力自动从 4 兆瓦降到 3 兆瓦,另一份数字一览表格把同一场示范写成一分钟内降低 40% 的电力需求。官方没有自己说明这两个数字之间的关系,本文把两个数字都列出来,不替官方选一个当作唯一答案。
这件事跟台湾有关系吗?
本文查核的两篇 9 月 15 日公告里,没有出现台湾或台积电。唯一的关联是,DSX 这套电力管理软件本身是 5 月在 GTC Taipei(NVIDIA 在台湾举办的活动)发布的,但公告没有进一步说明任何台湾的部署、合作伙伴或供应链细节,本文也不替官方补上。
Vera Rubin 现在能买到吗、多少钱?
官方说法是已进入全面生产,并持续在生态系中扩大部署,但没有公布出货数量、客户名单或云端地区清单;1 月的新闻稿写合作伙伴产品预计 2026 年下半年提供,9 月 15 日的材料没有更新这个时程。本文查核到的两篇 9 月 15 日公告都没有写出 Vera Rubin、Groq 3 LPX 或 DSX 任何一项的售价或授权费,本文也不做应不应该采用的建议。
SemiAnalysis 说的 30 倍是什么意思?
那是 NVIDIA 转述第三方测试机构 SemiAnalysis 用 AgentX 方法量到的结果:在 DeepSeek V4 Pro 模型上,Vera Rubin NVL72 相对 GB300 NVL72 每兆瓦吞吐量最高 30 倍。这是 NVIDIA 引用别家机构的测试,本站没有取得 SemiAnalysis 的原始数据,只能记录 NVIDIA 是怎么引用的。
2026 年科技新闻总整理:硬件、平台、电信与法规的重点2026 年科技新闻总整理:硬件、平台、电信与法规的重点整理本站 2026 年的科技新闻解析,分成硬件、平台、计算基础设施、台湾政策与欧盟法规五组:iPhone Duo 与九月新机、M6 与 M5 Ultra、Snapdragon 8 Elite Gen 6、Project Zenith、Pixel Drop、App Store 订阅新规则、WordPress 与 Synology 的安全更新、NVIDIA 三则公告、6G 频谱研讨会、台马海缆、主权 AI 语料库、《网络弹性法案》通报义务、KIDS Act 提案、Apple 欧盟 App 条款与追踪透明度询问框。不做购买建议,厂商宣称一律归因,每篇都附官方来源与查核日。阅读全文
NVIDIA 为 CUDA-Q 开源平台新增 CUDA-Q Logical:估算容错量子计算机规模,不是量子计算机本身NVIDIA 为 CUDA-Q 开源平台新增 CUDA-Q Logical:估算容错量子计算机规模,不是量子计算机本身2026 年 9 月 14 日,NVIDIA 宣布为开源的 CUDA-Q 平台新增 CUDA-Q Logical,这是一个协调层,用来帮助研究者估算容错量子计算应用需要多少硬件,而不是新的量子计算机。本文依据 NVIDIA 新闻稿与技术文档,说明这个工具能做与不能做的事、新闻稿和技术文档用词的落差,以及桑迪亚国家实验室(Sandia National Laboratories)开发的跨平台基准 QUOPS。查核日 2026 年 9 月 17 日。阅读全文
同主题延伸阅读
生活分享
NVIDIA Rubin 在 CES 亮相:AI 算力升级会如何影响日常服务?
分析 NVIDIA Rubin 数据中心计算平台对日常云端 AI 服务的实质影响,探讨推理成本、排队延迟与企业实际账单之关联。
生活分享
NVIDIA 为 CUDA-Q 开源平台新增 CUDA-Q Logical:估算容错量子计算机规模,不是量子计算机本身
2026 年 9 月 14 日,NVIDIA 宣布为开源的 CUDA-Q 平台新增 CUDA-Q Logical,这是一个协调层,用来帮助研究者估算容错量子计算应用需要多少硬件,而不是新的量子计算机。本文依据 NVIDIA 新闻稿与技术文档,说明这个工具能做与不能做的事、新闻稿和技术文档用词的落差,以及桑迪亚国家实验室(Sandia National Laboratories)开发的跨平台基准 QUOPS。查核日 2026 年 9 月 17 日。
生活分享
NVIDIA 投资联发科技 35 亿美元:合作深化公告与可转债申报书各写了什么
2026 年 8 月 31 日,NVIDIA 与联发科技(MediaTek)宣布深化在 AI 基础设施、边缘 AI 计算与车用三大领域的合作,NVIDIA 并投资 35 亿美元于联发科技发行的可转换公司债券(可转债)。本文依官方新闻稿与联发科技向公开信息观测站申报的定价公告,整理新闻稿写了什么、申报书另外披露哪些发行条件,以及这几份文件没有交代的部分,查核日 2026 年 9 月 17 日。
生活分享
Cloudflare 推出 Traces 公开测试版:网站运营者可在一条时间轴上看清请求经过平台的每一步
Cloudflare 于 2026 年 10 月 2 日宣布推出 Cloudflare Traces 公开测试版。使用 Cloudflare 的网站运营者与开发者,可在同一条时间轴上看到请求经过安全规则、缓存、路由与源服务器的过程,便于找出请求被拦截或变慢的原因。新的计价方式自 2026 年 12 月 1 日起生效。信息出自 Cloudflare 官方博客。
引用本文的文章
最新旅游情报攻略

攻略东京
东京住哪一区:新宿、上野、东京站、涩谷、浅草、池袋、银座七区比较,机场交通、住宿税、行李寄送一次看
东京住哪一区?用同一套标准比较新宿、上野、东京站、涩谷、浅草、池袋、银座七个区域:从成田、羽田机场怎么过来、有哪些线路、周边有什么、街区氛围、适合谁。附比较表与山手线示意图,以及 2026 年 9 月核实的东京都住宿税(2027 年 4 月改为 3%)和机场宅急便寄送行李的规则。
- 预算
- 酒店

攻略东京
东京交通票券怎么选:Suica/Welcome Suica、Tokyo Subway Ticket、JR Pass 值不值得买
第一次去东京,每人先用一张 IC 卡按次付费(Welcome Suica 免押金、有效期 28 天)。一天搭四趟以上地铁,再加买 2,000 日元的 Tokyo Subway Ticket 72 小时券;只玩东京、不去关西,买 JR Pass 一定不划算。用决策图比较 TOURIST PASMO、iPhone 里的 Suica、东京 Metro 一日券能搭什么、不能搭什么;价格于 2026 年 9 月核实。
- 交通
- 预算

攻略东京
东京迪士尼乐园、海洋攻略:票价、梦幻泉乡 Fantasy Springs、尊享卡 DPA 与预约等候卡怎么用,第一次去选哪个园区
东京迪士尼一日护照采用浮动票价,2026 年 9 月平日大多为 9,900 日元、周末为 10,900 日元,官网每天 14:00 开售两个月后同一天的门票;免费的优先通行卡已不在官网服务清单,缩短排队时间只剩付费的迪士尼尊享卡(每人每次 1,000 至 3,500 日元)。另有运营时间与 25 周年活动、预约等候卡与报名体验、梦幻泉乡如何进入,以及第一次去选乐园还是海洋;2026 年 9 月通过东京迪士尼度假区官网核实。
- 行程范例
- 亲子
资料来源
- AI Infra Summit: NVIDIA Vera Rubin and DSX Platform Advancements Showcase Energy Efficiencies of Optimizing Tokens Per Watt for AI Factories · 查证日期:
- From Megawatts to Tokens: How NVIDIA Maximizes AI Factory Production · 查证日期:
- NVIDIA Kicks Off the Next Generation of AI With Rubin — Six New Chips, One Incredible AI Supercomputer · 查证日期:
- NVIDIA Groq 3 LPX Now in Full Production With World-Class Speed for Agentic AI · 查证日期: