生活分享

NVIDIA AI Infra Summit 谈电力效率:Vera Rubin 与 DSX 新增了什么

2026 年 9 月 15 日,NVIDIA 在加州圣塔克拉拉的 AI Infra Summit 上介绍 Vera Rubin 平台与 DSX 机房电力管理软件,并表示衡量 AI 基础设施的指标正从峰值性能转向每兆瓦的 token 产出。本文依 NVIDIA 当天发布的官方博客与 1 月、8 月的新闻稿查核,说明这天新增了什么、哪些数字是实测、哪些官方自己标为投影,并整理官方尚未说明的部分。

阅读时间约 11 分钟

原创插图:从左到右依次是一颗芯片、一座装有四层设备的机柜、一栋排着九扇窗户的机房,三者以箭头相连;机房再以一条两端带圆点的虚线连到最右边的输电铁塔,代表芯片、机柜、机房与电网四个层级
图片:Mokaair (© Mokaair)

2026 年 9 月 15 日,据 NVIDIA 官方博客当天刊出的汇总文章,NVIDIA 副总裁 Ian Buck 在美国加州圣塔克拉拉会议中心举行的 AI Infra Summit 上,以 AI 机房效率为题发表基础设施主题演讲。

本文于 2026 年 9 月 17 日查核,读的是 NVIDIA 当天发布的两篇官方博客全文,以及 1 月 5 日、8 月 24 日两则官方新闻稿作为对照基准线。本站没有做任何实测,也不提供采购或升级建议;下文数字皆标明是 NVIDIA 自己测到的、自己投影的,或官方转述第三方测试机构的结果。

9 月 15 日发生了什么:从峰值性能到每兆瓦的 token

NVIDIA 在这篇汇总文章里表示,衡量 AI 基础设施的方式正快速从峰值性能转向经验证的代理式(agentic)每兆瓦 token 数,AI 机房须从芯片到电网整体协同设计;这句话把 9 月 15 日和 1 月的 CES 发布分开来——1 月谈芯片规格与每个 token 的成本,9 月谈机房整体能从每兆瓦电力挤出多少产出。

两篇 9 月 15 日公告里没有新的芯片发布,NVIDIA 列出的是生态系合作与合作伙伴实测:NVIDIA 表示 Amazon 旗下 Annapurna Labs 正与它合作开发 NVHBM 定制高带宽内存技术;d-Matrix 正整合 NVLink Fusion,让 Vera CPU 与自家 Raptor XPU 搭配做大规模的超低延迟推理;Pinterest 采用 Blackwell 平台与 Dynamo 推理软件,把对话式 AI 带进视觉探索。这三项官方各只给一句话,没有规格或时程;同一篇公告另有多家初创公司的 Vera CPU 测试结果与一段 NVLink 6 可靠性说明。

跟 1 月比,换了什么:芯片没变,测量的指标变了

1 月 5 日,NVIDIA 在 CES 发布 Rubin 平台,称之为六颗新芯片(Vera CPU、Rubin GPU 等)。头条数字是性能面:比 Blackwell 平台最高省 10 倍推理每 token 成本、训练混合专家模型最高少用 4 倍 GPU,新闻稿用未来式写相关产品预计 2026 年下半年由合作伙伴提供。8 月 24 日 Hot Chips 大会,NVIDIA 宣布 Groq 3 LPX 全面量产,称平台横跨七颗芯片、五款专用机柜;商标声明只写 Groq 与 LPU 名称经 Groq, Inc. 授权使用,查核到的官方文件没有并购或收购 Groq 的说法。

到了 9 月 15 日,两篇官方博客都没有再出现新的芯片名称;1 月的新闻稿整篇没有用兆瓦当衡量单位,9 月 15 日的两篇则反复以每兆瓦能产出多少 token 描述成果。换句话说,9 月 15 日新增的不是硬件,而是把 DSX 电力管理软件推到第一批合作伙伴实测与商用示范的阶段。

根据 NVIDIA 于 2026 年 1 月 5 日、8 月 24 日、9 月 15 日与 9 月 16 日发布的公告整理,查核日 2026 年 9 月 17 日。
时间点官方说的主体官方给的数字与条件
2026-01-05CES:Rubin 六芯片平台发布官方称比 Blackwell 平台最高省 10 倍每 token 推理成本、少 4 倍训练 GPU
2026-08-24Hot Chips:Groq 3 LPX 宣布量产官方称平台合计七颗芯片、五款机柜;Groq、LPU 名称授权自 Groq, Inc.
2026-09-15AI Infra Summit:DSX 电力软件与合作伙伴实测官方称 Lambda 测到吞吐量多 24%;Vera Rubin 的 40% 是官方投影
2026-09-16同一篇公告追加 MLPerf v6.1 预览结果官方称 Vera Rubin NVL72 吞吐量最高是 GB300 NVL72 的 3.7 倍

电力为什么是瓶颈:DSX MaxLPS 与 DSX Flex 在做什么

NVIDIA 引创始人兼首席执行官黄仁勋的话解释电力为何是瓶颈:一座 1 吉瓦(GW)的机房永远不会变成一座 2 吉瓦的机房;NVIDIA 在同一篇里写电力就是 AI 机房经济里的限制条件。DSX 软件不是 9 月 15 日才推出,官方写 DSX 是 5 月在 GTC Taipei(NVIDIA 在台湾的活动)发布的,没有写年份;两篇 9 月 15 日公告都没有再提到台湾的部署、合作伙伴或供应链,本文不替官方延伸。

DSX MaxLPS 处理机房内部的电力调度:NVIDIA 表示在 AI 工厂(AI factory,NVIDIA 对 AI 机房的称呼)这一层级,MaxLPS 会随需求动态调度机柜间电力,在同一场地电力额度内最高多出 40% 的 GPU,且不必新建输电线路就最高多出 35% 的 token 吞吐量;机柜层级另有削峰软件与扩充储能吸收短暂尖峰,官方在这一层没有给百分比。这组电力数字里有合作伙伴实测的是 Lambda:19 个节点在 85% 电力政策下跑在原本 16 个满载节点的电力预算内,NVIDIA 称集群吞吐量多 24%、每瓦性能多 23%,但测的是 Blackwell 世代 HGX B200 服务器,不是 Vera Rubin,Lambda 云服务总裁称这是概念验证。上面那个 40% 挂到 Vera Rubin NVL72 时,配套那篇官方文章标明它依 NVIDIA 自己的投影、限于合适的部署环境,同篇数字表还写明要搭配机房电力规划,不是测量结果。

DSX Flex 处理机房与电网之间的沟通:接收降载请求、需求响应事件与电价信号,在默认工作优先顺序内自动反应,让最重要的工作持续运行、其余暂停后再恢复。NVIDIA 举的例子是自家 Eos 机房参与硅谷电力公司弹性负载互联方案,搭配 Emerald AI 的 Conductor:正文写某个 8 月夜晚电力自动从 4 兆瓦降到 3 兆瓦,同页一张照片说明也写同样两个数字;但同文数字一览表却把同一场示范写成一分钟内降低 40% 的电力需求,NVIDIA 未说明两者关系。官方称之后已送出超过两百次需求信号、每次都成功,但这场示范还不是正式的 DSX Flex 安装,只是证明概念可行。

四格图解:芯片、机柜、机房、电网四个层级的电力与效率调度
根据 NVIDIA 2026 年 9 月 15 日发布的两篇博客文章整理,查核日 2026 年 9 月 17 日。 · 图片:Mokaair (© Mokaair)

怎么读 NVIDIA 给的数字:哪些是实测、哪些是投影

接上 Groq 3 LPX 后,NVIDIA 的头条数字是:对两万亿参数以上、长上下文模型,合并平台每兆瓦 token 吞吐量最高是 GB200 NVL72 的 35 倍;较具体的是 Groq 3 LPX 在 10 万 token 上下文的 Qwen 3.8 27B 负载下,每位用户每秒测到 2,529 个输出 token,两者都带着比较基准,拿掉条件单独引用会失真。NVIDIA 也转述第三方机构 SemiAnalysis 用 AgentX 方法量到的结果:DeepSeek V4 Pro 模型上,Vera Rubin NVL72 相对 GB300 NVL72 每兆瓦吞吐量最高 30 倍,这是 NVIDIA 转述别家机构的测试,本站未取得原始数据。

对供货状态,两篇 9 月 15 日博客给的只有一句:Vera Rubin 已全面生产,并持续在生态系中扩大部署,性能会随软件优化改善,没有出货数量、客户名单或云端地区清单。这篇博客是持续更新的动态文章:它在 9 月 16 日(活动隔天)新增一段 MLPerf Inference v6.1 结果,NVIDIA 称这是 Vera Rubin NVL72 首次 MLPerf 预览提交,吞吐量最高是 GB300 NVL72 的 3.7 倍;这段内容属于 9 月 16 日,不是 9 月 15 日当天发生的事。

对用云端服务的人代表什么、以及官方没说什么

以上数字量的都是机房层级指标:每兆瓦 token 产出、每瓦性能、同电力额度下能放多少 GPU,没有一项是对终端云端服务速度、费率或供货时间的承诺。硬件效率会不会反映到订阅月费,先前 CES 报道已拆解过推理成本与终端定价的落差,这里不重复;两篇 9 月 15 日公告通篇没有提到 Vera Rubin、Groq 3 LPX 或 DSX 任何一项的售价或授权费,只在描述电网信号时出现过电价。

两篇公告以 Taiwan 与 TSMC 查核到 2026 年 9 月 17 日都未见,没有台湾部署、台湾合作伙伴或供应链的说明;与台湾有关的只有前一节提到 DSX 是在 GTC Taipei 发布的。想自己确认现况,可回到这两篇博客本身——峰会那篇的最后更新时间在查核期间又往后移动过。读者之后若看到更新版本,应以官方页面当时内容为准。

常见问题

这场 AI Infra Summit 有发布新芯片吗?

没有。Vera Rubin 平台是 2026 年 1 月 5 日发布,Groq 3 LPX 是 8 月 24 日宣布量产;9 月 15 日这天,NVIDIA 官方博客谈的是电力管理软件、合作伙伴的第一批实测数字,以及多家初创公司在 Vera CPU 上跑出来的测试结果,本文查核到的两篇公告里都没有出现新的芯片名称。

DSX MaxLPS 让 Vera Rubin 机房多出 40% 的 GPU,这是测量出来的结果吗?

不是。这个 40% 指的是在同一电力预算内多放 40% 的 GPU,而在《从兆瓦到 token》那篇官方文章里,NVIDIA 标明它是依 NVIDIA 自己的投影、限于合适的部署环境,同篇的数字一览表还写明那是 MaxLPS 搭配机房电力规划的结果;同一件事在同日的峰会汇总文里没有标上投影两个字。这两篇里有测量数字的是 Lambda 的测试,吞吐量多 24%、每瓦性能多 23%,用的是 Blackwell 世代的 HGX B200 服务器,不是 Vera Rubin,Lambda 云服务总裁自己把这称为概念验证。

硅谷电力公司那场降载示范,电力到底降了多少?

NVIDIA 在同一篇公告里用了两种说法:正文与同页一张照片说明都写电力自动从 4 兆瓦降到 3 兆瓦,另一份数字一览表格把同一场示范写成一分钟内降低 40% 的电力需求。官方没有自己说明这两个数字之间的关系,本文把两个数字都列出来,不替官方选一个当作唯一答案。

这件事跟台湾有关系吗?

本文查核的两篇 9 月 15 日公告里,没有出现台湾或台积电。唯一的关联是,DSX 这套电力管理软件本身是 5 月在 GTC Taipei(NVIDIA 在台湾举办的活动)发布的,但公告没有进一步说明任何台湾的部署、合作伙伴或供应链细节,本文也不替官方补上。

Vera Rubin 现在能买到吗、多少钱?

官方说法是已进入全面生产,并持续在生态系中扩大部署,但没有公布出货数量、客户名单或云端地区清单;1 月的新闻稿写合作伙伴产品预计 2026 年下半年提供,9 月 15 日的材料没有更新这个时程。本文查核到的两篇 9 月 15 日公告都没有写出 Vera Rubin、Groq 3 LPX 或 DSX 任何一项的售价或授权费,本文也不做应不应该采用的建议。

SemiAnalysis 说的 30 倍是什么意思?

那是 NVIDIA 转述第三方测试机构 SemiAnalysis 用 AgentX 方法量到的结果:在 DeepSeek V4 Pro 模型上,Vera Rubin NVL72 相对 GB300 NVL72 每兆瓦吞吐量最高 30 倍。这是 NVIDIA 引用别家机构的测试,本站没有取得 SemiAnalysis 的原始数据,只能记录 NVIDIA 是怎么引用的。

最新旅游情报攻略

资料来源

生活分享