NVIDIA Vera Rubin:每瓦性能驱动,为全球合作伙伴提供最低代币成本

NVIDIA Blog 产品

摘要

NVIDIA宣布Vera Rubin平台,每兆瓦吞吐量比Blackwell提升10倍,并通过跨越七颗芯片和五个机架托盘的极致协同设计,为AI工厂提供最低的代币成本。

<div id="bsf_rt_marker"></div><p><span style="font-weight: 400;">NVIDIA </span><span style="font-weight: 400;">Vera Rubin来了,它将走向千兆规模。</span></p> <p><span style="font-weight: 400;">Vera Rubin NVL72的生产正在加速,机架已在合作伙伴</span><span style="font-weight: 400;">CoreWeave、</span><span style="font-weight: 400;">Google Cloud、Microsoft Azure</span><span style="font-weight: 400;">和</span><span style="font-weight: 400;">Oracle Cloud Infrastructure</span><span style="font-weight: 400;">运行。Vera Rubin遍布30个国家的350多个工厂站点,拥有有史以来最大、最成熟的机架规模供应链,以满足客户的计算需求。</span></p> <p><span style="font-weight: 400;">该</span><a target="_blank" href="https://www.nvidia.com/en-us/data-center/technologies/rubin/"><span style="font-weight: 400;">Vera Rubin平台</span></a><span style="font-weight: 400;">从芯片到电网构建,旨在提供最高的每瓦性能和最低的代币成本。</span><a target="_blank" href="http://coreweave.com/blog/nvidia-vera-rubin-nvl72-on-coreweave-10x-more-tokens-per-megawatt-than-blackwell"><span style="font-weight: 400;">CoreWeave的</span><span style="font-weight: 400;">首个基准测试</span></a><span style="font-weight: 400;">在DeepSeek-R1上说明了一切:每兆瓦吞吐量比Grace Blackwell NVL72高出10倍——直接落在了对电力受限的AI工厂最重要的指标上。</span></p> <h3><b>通过极致协同设计提升性能</b></h3> <p><span style="font-weight: 400;">实现这一点的关键是跨越七颗芯片和五个机架托盘的极致协同设计——Vera Rubin NVL72、Vera CPU机架、Groq 3 LPX、Spectrum-6 SPX和Vera BlueField-4 STX——所有这些都作为一个单一系统进行工程化,而不是从现成的独立产品组装而成。</span></p> <p><span style="font-weight: 400;">其核心是</span><a target="_blank" href="https://www.nvidia.com/en-us/data-center/vera-cpu/"><span style="font-weight: 400;">NVIDIA Vera CPU</span></a><span style="font-weight: 400;">。它重新定义了AI工厂CPU的可能性。专为智能体时代设计和构建,其定制Olympus核心提供2倍单线程性能、3倍核心间带宽和比竞争芯片组设计低40%的内存延迟,使其成为对最重要的智能体工作负载最高效的单线程CPU。</span></p> <h3><b>通过专用网络加速AI工厂</b></h3> <p><span style="font-weight: 400;">在网络方面,该平台的第六代</span><a target="_blank" href="https://developer.nvidia.com/blog/nvidia-nvlink-the-scale-up-network-for-ai-factories/"><span style="font-weight: 400;">NVLink</span></a><span style="font-weight: 400;">扩展网络在复杂工作负载上提供超过2倍的吞吐量、3倍更低的延迟和比现成以太网高10倍的数据包速率。对于扩展网络,Spectrum-X以太网结合了102.4T Spectrum-6交换机系统、1.6T ConnectX-9 SuperNIC、自适应路由、高级拥塞控制、遥测和开放操作系统支持,实现了比现成以太网高1.6倍的RDMA带宽。</span></p> <p><span style="font-weight: 400;">全球领先的AI基础设施构建者——包括CoreWeave、Microsoft、SpaceXAI和Tesla——是首批引入Spectrum-6交换机以加速其AI工厂的机构。NVIDIA的</span><a target="_blank" href="https://www.nvidia.com/en-us/networking/spectrumx/"><span style="font-weight: 400;">共封装光学光子学</span></a><span style="font-weight: 400;">用于扩展网络——业界首款此类批量生产的交换机——比可插拔收发器功耗降低5倍,MTBI提高10倍,</span><span style="font-weight: 400;">CoreWeave</span><span style="font-weight: 400;">、</span><span style="font-weight: 400;">Lambda</span><span style="font-weight: 400;">和</span><span style="font-weight: 400;">OCI</span><span style="font-weight: 400;">是首批采用者之一。</span></p> <p><span style="font-weight: 400;">Spectrum-XGS以太网将性能扩展到跨站点场景,多站点吞吐量提升1.9倍,因为千兆规模AI并非单个建筑的问题。</span></p> <p><span style="font-weight: 400;">而</span><a target="_blank" href="https://www.nvidia.com/en-us/data-center/nvlink-fusion/"><span style="font-weight: 400;">NVLink Fusion</span></a><span style="font-weight: 400;">将NVIDIA基础设施平台开放给第三方XPU,为合作伙伴提供基于经过验证的NVLink扩展网络栈和生态系统的更快的上市路径。</span></p> <h3><b>节省设置时间和水资源</b></h3> <p><span style="font-weight: 400;">NVIDIA的三代机架规模协同设计打造出的Vera Rubin NVL72系统,机架托盘内无电缆、风扇或软管,将计算托盘组装时间从数小时缩短至一分钟。</span></p> <p><span style="font-weight: 400;">45摄氏度的液冷入口温度设计实现了无需冷水机的干冷却器运行。对于新建的AI工厂,这种更高温度的干冷却与闭环液冷系统相结合,每年每兆瓦可节省数百万加仑的水。</span></p> <hr /> <p><em>太平洋时间7月21日星期二上午8:00 <b><a href="https://blogs.nvidia.com/blog/vera-rubin/#microsoft-mistral"><img src="https://s.w.org/images/core/emoji/17.0.2/72x72/1f517.png" alt="🔗" class="wp-smiley" style="height: 1em; max-height: 1em;" /></a></b></em></p> <h2 id="microsoft-mistral" class="wp-block-heading" style="scroll-margin-top: 100px;">NVIDIA Vera Rubin助力欧洲开源模型时代</h2> <p><img fetchpriority="high" decoding="async" class="alignnone size-medium wp-image-96696" src="https://blogs.nvidia.com/wp-content/uploads/2026/07/rollingblog-open-models-pr-1920x1080-1-960x540.png" alt="" width="960" height="540" srcset="https://blogs.nvidia.com/wp-content/uploads/2026/07/rollingblog-open-models-pr-1920x1080-1-960x540.png 960w, https://blogs.nvidia.com/wp-content/uploads/2026/07/rollingblog-open-models-pr-1920x1080-1-1680x945.png 1680w, https://blogs.nvidia.com/wp-content/uploads/2026/07/rollingblog-open-models-pr-1920x1080-1-1280x720.png 1280w, https://blogs.nvidia.com/wp-content/uploads/2026/07/rollingblog-open-models-pr-1920x1080-1-1536x864.png 1536w, https://blogs.nvidia.com/wp-content/uploads/2026/07/rollingblog-open-models-pr-1920x1080-1-1290x725.png 1290w, https://blogs.nvidia.com/wp-content/uploads/2026/07/rollingblog-open-models-pr-1920x1080-1-630x354.png 630w, https://blogs.nvidia.com/wp-content/uploads/2026/07/rollingblog-open-models-pr-1920x1080-1-300x169.png 300w, https://blogs.nvidia.com/wp-content/uploads/2026/07/rollingblog-open-models-pr-1920x1080-1-400x225.png 400w, https://blogs.nvidia.com/wp-content/uploads/2026/07/rollingblog-open-models-pr-1920x1080-1.png 1920w" sizes="(max-width: 960px) 100vw, 960px" /></p> <p><span style="font-weight: 400;">Vera Rubin正在为欧洲的AI基础设施提供下一代性能。</span></p> <p><span style="font-weight: 400;">它是微软和Mistral新扩展合作的基础,将前沿AI引入该地区,结合欧洲开源模型与云端和客户控制的环境,使政府和受监管行业能够按照自己的条件采用它。</span></p> <p><span style="font-weight: 400;">支撑该合作是一项新的数十亿美元协议,专注于扩大欧洲的AI基础设施。Mistral正在增加其GPU容量,利用数千颗最新的NVIDIA Vera Rubin GPU来提高客户可用的AI计算能力,并为训练、推理和大规模部署提供共享平台。</span></p> <p><a target="_blank" href="https://www.nvidia.com/en-us/data-center/vera-rubin-nvl72/"><span style="font-weight: 400;">NVIDIA Vera Rubin</span></a><span style="font-weight: 400;">正在加速</span>
查看原文
查看缓存全文

缓存时间: 2026/07/21 18:37

# NVIDIA Vera Rubin:全球合作伙伴的性能功耗比与最低令牌成本 来源:https://blogs.nvidia.com/blog/vera-rubin/ NVIDIA Vera Rubin 来了,它将迈向吉级规模。 Vera Rubin NVL72 正在量产,机架已在合作伙伴 CoreWeave、Google Cloud、Microsoft Azure 和 Oracle Cloud Infrastructure 运行。覆盖全球30个国家超过350个工厂站点,Vera Rubin 拥有有史以来最庞大、最成熟的机架级供应链,以满足客户的计算需求。 Vera Rubin 平台(https://www.nvidia.com/en-us/data-center/technologies/rubin/)从芯片到电网构建,以提供最高的性能功耗比和最低的令牌成本。CoreWeave 在 DeepSeek-R1 上的首次基准测试(http://coreweave.com/blog/nvidia-vera-rubin-nvl72-on-coreweave-10x-more-tokens-per-megawatt-than-blackwell)说明了一切:每兆瓦吞吐量比 Grace Blackwell NVL72 提升10倍——直接扣准了受功耗约束的AI工厂最关键的指标。 ### **通过极致协同设计提升性能** 实现这一点的关键在于七款芯片与五个机架托盘之间的极致协同设计——Vera Rubin NVL72、Vera CPU 机架、Groq 3 LPX、Spectrum-6 SPX 和 Vera BlueField-4 STX——所有这些作为一个单一系统进行工程化,而非由单独的现成产品组装而成。 NVIDIA Vera CPU(https://www.nvidia.com/en-us/data-center/vera-cpu/)是其核心。它重新定义了AI工厂CPU的形态。为智能体时代设计和构建,其定制 Olympus 核心相比竞品小芯片设计,单线程性能提升2倍,核心间带宽提升3倍,内存延迟降低40%,使其成为面向最重要的智能体工作负载的最高效单线程CPU。 ### **借助专用网络加速AI工厂** 在网络方面,平台第六代 NVLink(https://developer.nvidia.com/blog/nvidia-nvlink-the-scale-up-network-for-ai-factories/)纵向扩展在复杂工作负载上提供超过2倍的吞吐量,延迟降低3倍,数据包速率比现成以太网高10倍。对于横向扩展,Spectrum-X 以太网结合了102.4T Spectrum-6 交换机系统、1.6T ConnectX-9 SuperNIC、自适应路由、高级拥塞控制、遥测和开放操作系统支持,使 RDMA 带宽比现成以太网提升1.6倍。 全球领先的AI基础设施构建商——包括 CoreWeave、Microsoft、SpaceX AI 和 Tesla——是首批引入 Spectrum-6 交换机以加速其AI工厂的公司。用于横向扩展的 NVIDIA Photonics 共封装光学(https://www.nvidia.com/en-us/networking/spectrumx/)——业界首款量产的此类交换机——相比可插拔收发器,功耗降低5倍,MTBI 提升10倍,CoreWeave、Lambda 和 OCI 是首批采用者。 Spectrum-X GS 以太网将性能扩展到跨站点环境,多站点吞吐量提升1.9倍,因为吉级AI不是单个建筑的问题。 NVLink Fusion(https://www.nvidia.com/en-us/data-center/nvlink-fusion/)将NVIDIA基础设施平台开放给第三方XPU,让合作伙伴借助成熟的 NVLink 纵向扩展栈和生态系统,更快地进入市场。 ### **节省设置时间与水** NVIDIA 三代机架级协同设计造就了 Vera Rubin NVL72 系统,托盘中无需线缆、风扇或软管,将计算托盘组装时间从数小时缩短至一分钟。 45摄氏度液冷入口温度设计支持无需冷水机组的干式冷却器运行。对于新建的AI工厂,这种高温干式冷却结合闭路液冷系统,每年每兆瓦可节省数百万加仑的水。 --- *太平洋时间7月21日星期二上午8:00* 🔗 (https://blogs.nvidia.com/blog/vera-rubin/#microsoft-mistral) ## NVIDIA Vera Rubin 为欧洲开放模型时代提供动力 Vera Rubin 正在为欧洲的AI基础设施提供下一代性能。 它是微软与 Mistral 新近扩大合作的基础,该合作将前沿AI引入该地区,结合开放的欧洲模型与云及客户受控环境,使政府和受监管行业能够按自身条件采用。 这一合作的基础是一项新的数十亿美元协议,专注于扩大欧洲的AI基础设施。Mistral 正在增加其GPU容量,利用数千颗最新的 NVIDIA Vera Rubin GPU 来扩大客户可用的AI计算能力,并为训练、推理和大规模部署提供共享平台。 NVIDIA Vera Rubin(https://www.nvidia.com/en-us/data-center/vera-rubin-nvl72/)正在全面量产。这款机架级AI超级计算机统一了七款新芯片,作为单一系统协同设计,将为下一代 Mistral Compute 和微软的欧洲AI基础设施提供动力,利用数万颗GPU。 欧洲希望拥有世界上最强大的AI,在其自身法律下运行,靠近本土,并完全处于其控制之下。而且门槛不断提高:智能体系统可能消耗多达传统AI应用15倍的令牌(https://developer.nvidia.com/blog/building-for-the-rising-complexity-of-agentic-systems-with-extreme-co-design/),使得高效基础设施成为战略优先事项。满足这一期望不仅仅是计算容量的问题:AI需要高效扩展,同时满足数据控制、治理、弹性和战略自主的区域要求。 Vera Rubin 为欧洲的开放模型生态系统提供了计算基础。其全栈架构结合了加速计算、网络和软件,使模型和智能体从训练到生产都能高效运行。 ### **面向企业AI的开放模型** 微软、Mistral 和 NVIDIA 共同在公共云、云连接和完全离线的私有云环境中交付主权就绪型AI——将开放模型的灵活性与规模化运行所需的基础设施相结合。 Mistral Medium 3.5 和 OCR 4 现已在 Microsoft Foundry 中提供,Mistral 模型已集成到 Microsoft Copilot Studio 中。通过 Azure Local 和 Foundry Local,客户可以在云和客户受控环境中使用相同的模型、工具和操作模式。 ### **符合欧洲条件的AI** 政府机构可以将AI应用于敏感工作流。医疗和金融服务组织可以在区域要求内部署。制造商可以就地处理数据以加快决策。与 NVIDIA GB200 NVL72 相比,Vera Rubin NVL72 每兆瓦最多提供10倍的令牌,每百万令牌成本降低十分之一,在相同功耗范围内提供更多智能。 主权AI不应迫使组织在创新、经济性和控制之间做出选择。借助 Vera Rubin 作为计算基础——以及微软和 Mistral 提供的主权云基础设施和开放欧洲模型——欧洲可以三者兼得。 *阅读微软与 Mistral 的新闻稿* (https://news.microsoft.com/source/2026/07/21/microsoft-and-mistral-expand-strategic-partnership-to-give-enterprises-and-regulated-industries-frontier-ai-they-can-control/) *了解更多详情。* --- *太平洋时间7月21日星期二上午8:00* 🔗 (https://blogs.nvidia.com/blog/vera-rubin/#coreweave) ## CoreWeave 上的 NVIDIA Vera Rubin NVL72 在基准测试中展示比 Blackwell 高10倍的每兆瓦令牌数 通过与 NVIDIA 的极致协同设计,CoreWeave 在 Vera Rubin NVL72 上实现了数量级的性能飞跃。 与 CoreWeave 等合作伙伴的紧密合作对于将新一代 NVIDIA 加速计算引入AI工厂至关重要。 经过数月的协同工程工作,CoreWeave 成为(https://www.coreweave.com/news/coreweave-completes-industry-first-bring-up-of-nvidia-vera-rubin-nvl72?utm_campaign=_2026-q2_global_training_&utm_medium=organic&utm_source=twitter-&utm_content=coreweave-blog_blg)首家启动并验证 Vera Rubin NVL72 的AI云——现在它分享了来自真实硬件的首批实测性能数据。 CoreWeave 在 Vera Rubin NVL72 上运行了 DeepSeek-R1 基准测试,结果显示每兆瓦每秒令牌数相比 Grace Blackwell NVL72 提升了10倍。 每兆瓦令牌数是决定AI基础设施能否盈利扩展的指标。更多的每兆瓦令牌意味着相同功耗预算下获得更多智能,或者在显著更低的功耗(http://power.ai/)下完成相同工作负载。AI实验室和企业(如 Jane Street(https://www.coreweave.com/news/jane-street-signs-6-billion-ai-cloud-agreement-with-coreweave))将使用 Vera Rubin 平台在 CoreWeave 云上扩展其AI工厂。 ### **借助 NVIDIA Spectrum-X 突破瓶颈** DeepSeek R1 的 MoE 架构使得全对全 GPU 通信成为大规模扩展的关键需求:每个令牌必须路由到分布式的专家子网络。Vera Rubin NVL72 的 260 TB/s 全对全 NVLink 6 结构消除了这一约束,使机架能够作为一个统一的加速器运行。 CoreWeave 是首批部署 NVIDIA Spectrum-X 以太网 SN6600-LD 作为 Vera Rubin NVL72 交换矩阵的公司之一。 基于 102.4 Tb/s Spectrum-6 交换机芯片,采用液冷设计,CoreWeave 部署了密集交换式机架,每个机架提供 1.64 Pb/s 的容量,比上一代风冷交换机容量提升100%。CoreWeave 还提供了完全无阻塞、多平面、多轨 spine-leaf 架构,连接 Vera Rubin NVL72 GPU,无过订阅。 --- *太平洋时间7月21日星期二上午8:00* 🔗 (https://blogs.nvidia.com/blog/vera-rubin/#google-cloud) ## NVIDIA Vera Rubin NVL72 为 Google Cloud 全新 A5X 实例驱动 Ineffable Intelligence 由 NVIDIA Vera Rubin NVL72 和 Google Virgo 网络(用于数据中心横向扩展结构)提供支持的 Google Cloud A5X 实例。图片由 Google Cloud 提供。 NVIDIA Vera Rubin NVL72 正在为 Google Cloud 的首个 A5X 实例提供动力,该实例现已上线,服务于伦敦初创公司 Ineffable Intelligence。 Ineffable Intelligence 开发新一代智能“超级学习器”系统,这些系统通过经验持续学习,在各个领域发现新突破。 Ineffable Intelligence 的智能体直接从与环境的交互中学习,而非来自静态数据集。与使用大型语言模型不同,Ineffable 正在通过强化学习开发“超级学习器”系统,在持续模拟的大规模并行环境中生成经验,并快速将这些经验转化为策略更新和评估。这些紧密耦合的学习循环对计算、内存带宽和互连提出了特殊要求,需要能够以极低延迟在巨大规模下运行的基础设施。 “研究的下一个时代需要硬件的下一个时代,”Ineffable Intelligence 联合创始人 Lasse Espeholt 表示。“我们很荣幸能与 NVIDIA 和 Google Cloud 的团队合作,他们让我们能够早期接触 Vera Rubin。两个团队的支持无与伦比;我们几乎立即就启动并运行起来,并且已经在为我们的超级学习器测试基础设施。” NVIDIA Vera Rubin NVL72 正是为此类智能体训练(https://blogs.nvidia.com/blog/nvidia-vera-rubin-post-training-intelligence-per-dollar/)而设计,提供可预测的延迟、高利用率以及比上一代系统显著更多的每美元智能,使其成为大规模强化学习的自然平台选择。 Google Cloud A5X 实例在 Google Cloud Next(https://blogs.nvidia.com/blog/google-cloud-agentic-physical-ai-factories/)上发布,是基于 NVIDIA Vera Rubin NVL72 机架级系统的裸金属实例,提供比上一代低10倍的每令牌推理成本和10倍的每兆瓦令牌吞吐量。 A5X 使用 NVIDIA ConnectX-9 SuperNIC 结合下一代 Google Virgo 网络,使集群能够在一个站点内扩展到数万颗 NVIDIA Rubin GPU,并在多站点配置中扩展到近百万颗 GPU,为客户提供统一、AI 优化的堆栈,用于训练、调优和服务前沿、开放、智能体和物理AI模型,同时优化性能、成本和可持续性。 该基础设施旨在帮助解锁下一代强化学习系统,以实现超级学习和超级智能的突破。 --- *太平洋时间7月21日星期二上午8:00* 🔗 (https://blogs.nvidia.com/blog/vera-rubin/#deepinfra) ## NVIDIA Vera CPU 为 DeepInfra AI 云提供两倍的协调速度 DeepInfra 的基准测试结果显示,NVIDIA Vera CPU 的速度是其他 CPU 的两倍以上,并且可以支持更多并发AI智能体。 云平台 DeepInfra 是 NVIDIA 开放AI生态系统的早期访问参与者,它使用其生产级AI智能体基础设施独立设计和运行了基准测试。DeepInfra 每周处理近五万亿个令牌,其中约30%来自智能体系统。其云平台专为高吞吐量AI推理而构建。 基准测试表明,在相同的服务质量下,NVIDIA Vera CPU 可支持多达1.6倍的并发AI智能体,并且协调速度比替代 CPU 快2.2倍,同时提高了基础设施利用率和成本效率。这些结果表明,NVIDIA Vera CPU 能够满足生产级智能体AI所需的成本效率、低延迟和高吞吐量。 随着AI智能体承担更复杂的推理、规划、工具使用和数据移动,CPU 性能对于协调每个模型调用周围的工作变得越来越重要。 作为 NVIDIA 极致协同设计方法的一部分,Vera CPU 专为智能体工作负载而构建。DeepInfra 的基准测试凸显了 NVIDIA Vera CPU 如何帮助云提供商提高基础设施利用率、增加成本效率,并在相同服务质量下支持更多并发AI智能体。 *了解更多关于 NVIDIA Vera Rubin 平台(https://www.nvidia.com/en-us/data-center/technologies/rubin/)的信息。*

相似文章

NVIDIA刚刚发布了全新的Vera CPU——据称比x86快两倍

Reddit r/ArtificialInteligence

NVIDIA宣布了采用全新Vera架构的CPU,该架构从头开始为智能代理AI和强化学习而设计,声称性能达到x86替代方案的两倍。Vera Rubin NVL72平台集成了72个GPU和36个CPU,主要客户包括Meta、Oracle和Alibaba。