生活分享
NVIDIA:AI 云服务商 CoreWeave 开始提供 Vera Rubin NVL72 系统,Cognition 成为首个生产客户
据 NVIDIA 博客,专为 AI 打造的云服务商 CoreWeave 宣布在云端提供 NVIDIA 新一代 Vera Rubin NVL72 系统,将推出专为 AI 智能体设计的 Vera CPU,并发布模型与智能体改进平台 CoreWeave Forge。这关系到开发 AI 应用的企业,也可能间接影响普通用户所用 AI 服务的响应速度。
阅读时间约 6 分钟

发生了什么
NVIDIA 博客于 2026 年 9 月 30 日发文称,CoreWeave 在当周于旧金山举行的 CoreWeave Fully Connected 活动上,宣布提供 NVIDIA Vera Rubin NVL72 系统,并搭配 Spectrum-X 102.4T 以太网(用于连接大量服务器的高速网络)。NVIDIA 将 CoreWeave 描述为专为 AI 打造的云服务,并表示 CoreWeave 因此成为最早将该平台交到客户手中的云服务商之一。
据 NVIDIA 博客,Cognition 是一家应用 AI 实验室,开发了 AI 软件工程师 Devin。它是首个在 Vera Rubin 上运行生产工作负载的客户,也就是用该系统支撑真实业务,而不只是做测试。NVIDIA 称,CoreWeave 于本月早些时候收到首批 Vera Rubin NVL72 生产机柜,并在数天内为 Cognition 搭建了生产用集群(由大量服务器组成的计算群组)。
阅读完整文字说明
消息会先收集来源、独立核查,再交由 Jev 判断。
此外,NVIDIA 表示 CoreWeave 还将提供 NVIDIA Vera CPU,并推出 CoreWeave Forge。Forge 是一个在 NVIDIA 加速计算上训练、评估与改进模型及智能体的集成环境。智能体指能够自主完成多步骤任务的 AI 程序。NVIDIA 副总裁 Ian Buck 另指出,CoreWeave 的 V100 GPU 在 Volta 推出近十年后仍在运行客户工作负载。
NVIDIA 公布的性能数据
据 NVIDIA 博客,Cognition 以 GB200 NVL72 为比较基准,做法是从 FrontierCode 中抽取一部分任务,再由 AI 智能体解题,以此模拟真实的软件工程工作负载。早期测试显示,在 SWE-2 推理工作负载上,Vera Rubin NVL72 的总 token 吞吐量最高提升 4.8 倍。token 是 AI 模型处理文字的基本单位,吞吐量指单位时间内能处理的 token 数量。Cognition 创始团队成员 Silas Alberti 表示,智能体式编程涉及长上下文、高并发与海量 token,每个 token 的成本决定了他们能推出什么。
在 CPU 方面,NVIDIA 称 CoreWeave 的 Vera 部署在单个机柜中放入 128 颗 CPU、11,264 个核心。若每个环境使用一个核心,可支撑超过 11,000 个并发环境。这里的环境指沙箱,即供 AI 智能体运行代码、彼此隔离的独立空间。CoreWeave 在测试中实现了超过 3 倍的智能体沙箱启动速度提升,并在 Terminal-Bench 测试所有通过的任务上看到 1.7 倍的性能提升。
| 项目 | NVIDIA 博客所述内容 | 状态 |
|---|---|---|
| Vera Rubin NVL72 | 相比 GB200 NVL72,SWE-2 推理总 token 吞吐量最高 4.8 倍(Cognition 早期测试) | CoreWeave Cloud 已宣布提供 |
| NVIDIA Vera CPU | 单机柜 128 颗 CPU、11,264 核心;沙箱启动快 3 倍以上 | 将上线 CoreWeave Cloud |
| CoreWeave ARIA | 协助分析实验、提出实验与代码修改 | 正式提供 |
| CoreWeave Sandboxes | 在隔离的 CPU 或 GPU 环境中运行智能体、强化学习(RL)与评估 | 正式提供 |
| CoreWeave Agent Lens | 故障检测提升 20%,修复成本减半(官方说法) | 新服务 |
| RL Rollouts | 运行中加载新的模型存档(检查点),无需重新部署 | 私人预览 |
CoreWeave Forge 是什么
据 NVIDIA 博客,CoreWeave Forge 整合了 Weights & Biases、OpenPipe 的后训练专业能力与开源 marimo 笔记本项目。后训练指在模型初步训练完成后进一步调整、提升其表现。Forge 的目标是让模型在实际使用中的表现反馈到下一轮训练,并在不同模型、框架与云之间保持开放。其中 ARIA 与 Sandboxes 已正式提供,Agent Lens 为新服务。
NVIDIA 另称,无服务器强化学习的训练速度比自行管理的配置快 1.4 倍,成本低 40%。强化学习是让 AI 通过反复尝试和反馈来改进的训练方法;无服务器指用户无需自行管理服务器。开源推理框架 NVIDIA Dynamo 则支持 CoreWeave 的托管推理服务,以及处于私人预览阶段的 RL Rollouts。据 NVIDIA,Canva、Capital One 与 MasterClass 是最早在 Forge 上进行开发的公司之一。
对普通读者的意义
这则消息的重点在于,新一代 AI 硬件已开始进入云端,用于支撑真实业务。AI 编程助手等智能体式服务需要大量算力。如果 NVIDIA 所述的吞吐量提升在实际使用中成立,终端用户可能会感受到响应更快、多步骤推理更流畅。NVIDIA 还以医疗为例:据其说法,服务约 50,000 名 Medicare 患者、覆盖 15 个州的 Ennoble Care,将在 CoreWeave 上使用 RTX PRO 6000 GPU,扩展用于临床文档、决策支持与后勤自动化的 AI 智能体。
- 普通用户无需采取任何行动,这是云端与企业层面的基础设施更新。
- 对开发者而言,隔离沙箱与后训练工具的正式推出,可能降低打造 AI 智能体的门槛,但仍应以自身测试为准。
- 性能数字来自厂商与合作伙伴,后续是否有独立评测值得关注。
常见问题
Vera Rubin NVL72 是什么?
根据 NVIDIA 博客,这是 NVIDIA 的新一代 AI 基础设施系统,用于训练和运行 AI 模型。CoreWeave 宣布在其云端提供,并搭配 Spectrum-X 102.4T 以太网。
4.8 倍的性能提升可信吗?
这是 NVIDIA 援引 Cognition 早期测试的结果,指 SWE-2 推理工作负载上“最高”的提升幅度,比较基准为 GB200 NVL72,尚未经过独立验证。
谁是第一个用户?
据 NVIDIA 博客,开发 Devin 的 Cognition 是首个在 Vera Rubin 上运行生产工作负载的客户。
Vera CPU 和普通 CPU 有何不同?
NVIDIA 称 Vera 是首款专为 AI 智能体打造的 CPU,重点在于同时运行大量相互隔离的智能体环境。CoreWeave 的部署单机柜有 11,264 个核心。
这会影响我日常使用的 AI 服务吗?
可能会有间接影响。若基础设施性能提升如 NVIDIA 所述,采用这些云服务的 AI 应用可能响应更快,但实际效果取决于各服务商的部署情况。
同主题延伸阅读
生活分享
Cloudflare 开源 Streamline:演示如何用其云服务为直播加图、为视频烧录字幕
Cloudflare 于 2026 年 10 月 2 日推出并开源开发者实验平台 Streamline,演示开发者如何结合 Stream、Workers、Containers 与 Durable Objects,自行打造视频处理流程,例如为直播实时加上图标、为视频加上字幕。本文说明它是什么、如何运作、有哪些限制,以及对观众与开发者的意义。
生活分享
Google 发布 Gemini 4 Argon:先交网络防御者试用,普通用户仍需等待
Google 于 2026 年 9 月 30 日宣布前沿模型 Gemini 4 Argon,现阶段仅通过 Fairwind Program 提供给受信任的网络防御者。本文梳理 Google 公布的能力、价格、安全措施及对普通读者的影响;所有数据均来自 Google 自身。
生活分享
Google Cloud 宣布 Spanner Omni 正式推出:分布式数据库可部署于自有机房与其他云
Google Cloud 宣布 Spanner Omni 正式推出(GA),让 Spanner 分布式数据库可在自有数据中心、其他云或笔记本电脑上运行。本文整理 Google Cloud 公布的功能、授权方式以及与全托管版的差异。
生活分享
Google Cloud 推出 CLI 远程 MCP 服务器预览:让 AI 代理直接执行 gcloud 与 bq 命令
Google Cloud 宣布 Google Cloud CLI 远程 MCP 服务器进入公开预览,让兼容 MCP 的 AI 代理在云端隔离沙箱中执行 gcloud 与 bq 命令。本文整理其运作方式、Google 所称的安全机制、收费说明以及对普通读者的影响。
最新旅游情报攻略

攻略东京
东京住哪一区:新宿、上野、东京站、涩谷、浅草、池袋、银座七区比较,机场交通、住宿税、行李寄送一次看
东京住哪一区?用同一套标准比较新宿、上野、东京站、涩谷、浅草、池袋、银座七个区域:从成田、羽田机场怎么过来、有哪些线路、周边有什么、街区氛围、适合谁。附比较表与山手线示意图,以及 2026 年 9 月核实的东京都住宿税(2027 年 4 月改为 3%)和机场宅急便寄送行李的规则。
- 预算
- 酒店

攻略东京
东京交通票券怎么选:Suica/Welcome Suica、Tokyo Subway Ticket、JR Pass 值不值得买
第一次去东京,每人先用一张 IC 卡按次付费(Welcome Suica 免押金、有效期 28 天)。一天搭四趟以上地铁,再加买 2,000 日元的 Tokyo Subway Ticket 72 小时券;只玩东京、不去关西,买 JR Pass 一定不划算。用决策图比较 TOURIST PASMO、iPhone 里的 Suica、东京 Metro 一日券能搭什么、不能搭什么;价格于 2026 年 9 月核实。
- 交通
- 预算

攻略东京
东京迪士尼乐园、海洋攻略:票价、梦幻泉乡 Fantasy Springs、尊享卡 DPA 与预约等候卡怎么用,第一次去选哪个园区
东京迪士尼一日护照采用浮动票价,2026 年 9 月平日大多为 9,900 日元、周末为 10,900 日元,官网每天 14:00 开售两个月后同一天的门票;免费的优先通行卡已不在官网服务清单,缩短排队时间只剩付费的迪士尼尊享卡(每人每次 1,000 至 3,500 日元)。另有运营时间与 25 周年活动、预约等候卡与报名体验、梦幻泉乡如何进入,以及第一次去选乐园还是海洋;2026 年 9 月通过东京迪士尼度假区官网核实。
- 行程范例
- 亲子