生活分享

NVIDIA:AI 云服务商 CoreWeave 开始提供 Vera Rubin NVL72 系统,Cognition 成为首个生产客户

据 NVIDIA 博客,专为 AI 打造的云服务商 CoreWeave 宣布在云端提供 NVIDIA 新一代 Vera Rubin NVL72 系统,将推出专为 AI 智能体设计的 Vera CPU,并发布模型与智能体改进平台 CoreWeave Forge。这关系到开发 AI 应用的企业,也可能间接影响普通用户所用 AI 服务的响应速度。

阅读时间约 6 分钟

NVIDIA:AI 云服务商 CoreWeave 开始提供 Vera Rubin NVL72 系统,Cognition 成为首个生产客户
图片:Mokaair (Original editorial artwork)

发生了什么

NVIDIA 博客于 2026 年 9 月 30 日发文称,CoreWeave 在当周于旧金山举行的 CoreWeave Fully Connected 活动上,宣布提供 NVIDIA Vera Rubin NVL72 系统,并搭配 Spectrum-X 102.4T 以太网(用于连接大量服务器的高速网络)。NVIDIA 将 CoreWeave 描述为专为 AI 打造的云服务,并表示 CoreWeave 因此成为最早将该平台交到客户手中的云服务商之一。

据 NVIDIA 博客,Cognition 是一家应用 AI 实验室,开发了 AI 软件工程师 Devin。它是首个在 Vera Rubin 上运行生产工作负载的客户,也就是用该系统支撑真实业务,而不只是做测试。NVIDIA 称,CoreWeave 于本月早些时候收到首批 Vera Rubin NVL72 生产机柜,并在数天内为 Cognition 搭建了生产用集群(由大量服务器组成的计算群组)。

NVIDIA:AI 云服务商 CoreWeave 开始提供 Vera Rubin NVL72 系统,Cognition 成为首个生产客户
Mokaair 编辑核查流程 · 图片:Mokaair (Original editorial artwork)
阅读完整文字说明

消息会先收集来源、独立核查,再交由 Jev 判断。

此外,NVIDIA 表示 CoreWeave 还将提供 NVIDIA Vera CPU,并推出 CoreWeave Forge。Forge 是一个在 NVIDIA 加速计算上训练、评估与改进模型及智能体的集成环境。智能体指能够自主完成多步骤任务的 AI 程序。NVIDIA 副总裁 Ian Buck 另指出,CoreWeave 的 V100 GPU 在 Volta 推出近十年后仍在运行客户工作负载。

NVIDIA 公布的性能数据

据 NVIDIA 博客,Cognition 以 GB200 NVL72 为比较基准,做法是从 FrontierCode 中抽取一部分任务,再由 AI 智能体解题,以此模拟真实的软件工程工作负载。早期测试显示,在 SWE-2 推理工作负载上,Vera Rubin NVL72 的总 token 吞吐量最高提升 4.8 倍。token 是 AI 模型处理文字的基本单位,吞吐量指单位时间内能处理的 token 数量。Cognition 创始团队成员 Silas Alberti 表示,智能体式编程涉及长上下文、高并发与海量 token,每个 token 的成本决定了他们能推出什么。

在 CPU 方面,NVIDIA 称 CoreWeave 的 Vera 部署在单个机柜中放入 128 颗 CPU、11,264 个核心。若每个环境使用一个核心,可支撑超过 11,000 个并发环境。这里的环境指沙箱,即供 AI 智能体运行代码、彼此隔离的独立空间。CoreWeave 在测试中实现了超过 3 倍的智能体沙箱启动速度提升,并在 Terminal-Bench 测试所有通过的任务上看到 1.7 倍的性能提升。

CoreWeave 相关新服务与 NVIDIA 公布数据整理(资料来源:NVIDIA 博客)
项目NVIDIA 博客所述内容状态
Vera Rubin NVL72相比 GB200 NVL72,SWE-2 推理总 token 吞吐量最高 4.8 倍(Cognition 早期测试)CoreWeave Cloud 已宣布提供
NVIDIA Vera CPU单机柜 128 颗 CPU、11,264 核心;沙箱启动快 3 倍以上将上线 CoreWeave Cloud
CoreWeave ARIA协助分析实验、提出实验与代码修改正式提供
CoreWeave Sandboxes在隔离的 CPU 或 GPU 环境中运行智能体、强化学习(RL)与评估正式提供
CoreWeave Agent Lens故障检测提升 20%,修复成本减半(官方说法)新服务
RL Rollouts运行中加载新的模型存档(检查点),无需重新部署私人预览

CoreWeave Forge 是什么

据 NVIDIA 博客,CoreWeave Forge 整合了 Weights & Biases、OpenPipe 的后训练专业能力与开源 marimo 笔记本项目。后训练指在模型初步训练完成后进一步调整、提升其表现。Forge 的目标是让模型在实际使用中的表现反馈到下一轮训练,并在不同模型、框架与云之间保持开放。其中 ARIA 与 Sandboxes 已正式提供,Agent Lens 为新服务。

NVIDIA 另称,无服务器强化学习的训练速度比自行管理的配置快 1.4 倍,成本低 40%。强化学习是让 AI 通过反复尝试和反馈来改进的训练方法;无服务器指用户无需自行管理服务器。开源推理框架 NVIDIA Dynamo 则支持 CoreWeave 的托管推理服务,以及处于私人预览阶段的 RL Rollouts。据 NVIDIA,Canva、Capital One 与 MasterClass 是最早在 Forge 上进行开发的公司之一。

对普通读者的意义

这则消息的重点在于,新一代 AI 硬件已开始进入云端,用于支撑真实业务。AI 编程助手等智能体式服务需要大量算力。如果 NVIDIA 所述的吞吐量提升在实际使用中成立,终端用户可能会感受到响应更快、多步骤推理更流畅。NVIDIA 还以医疗为例:据其说法,服务约 50,000 名 Medicare 患者、覆盖 15 个州的 Ennoble Care,将在 CoreWeave 上使用 RTX PRO 6000 GPU,扩展用于临床文档、决策支持与后勤自动化的 AI 智能体。

  • 普通用户无需采取任何行动,这是云端与企业层面的基础设施更新。
  • 对开发者而言,隔离沙箱与后训练工具的正式推出,可能降低打造 AI 智能体的门槛,但仍应以自身测试为准。
  • 性能数字来自厂商与合作伙伴,后续是否有独立评测值得关注。

常见问题

Vera Rubin NVL72 是什么?

根据 NVIDIA 博客,这是 NVIDIA 的新一代 AI 基础设施系统,用于训练和运行 AI 模型。CoreWeave 宣布在其云端提供,并搭配 Spectrum-X 102.4T 以太网。

4.8 倍的性能提升可信吗?

这是 NVIDIA 援引 Cognition 早期测试的结果,指 SWE-2 推理工作负载上“最高”的提升幅度,比较基准为 GB200 NVL72,尚未经过独立验证。

谁是第一个用户?

据 NVIDIA 博客,开发 Devin 的 Cognition 是首个在 Vera Rubin 上运行生产工作负载的客户。

Vera CPU 和普通 CPU 有何不同?

NVIDIA 称 Vera 是首款专为 AI 智能体打造的 CPU,重点在于同时运行大量相互隔离的智能体环境。CoreWeave 的部署单机柜有 11,264 个核心。

这会影响我日常使用的 AI 服务吗?

可能会有间接影响。若基础设施性能提升如 NVIDIA 所述,采用这些云服务的 AI 应用可能响应更快,但实际效果取决于各服务商的部署情况。

查看同分类最新消息

最新旅游情报攻略

资料来源

生活分享