Nvidia 希望掌控 AI 数据中心内的每一块芯片

Wired 产品

摘要

Nvidia 正推广其新的 Vera Rubin 芯片系统,该系统结合了 GPU 和 CPU,旨在为数据中心提供完整的 AI 系统;OpenAI 已在使用一台机架。

Nvidia 的 Vera Rubin 平台将 CPU 和 GPU 整合到单个系统中,反映了该公司日益增长的雄心,即为 AI 基础设施的每一层提供动力。
查看原文
查看缓存全文

缓存时间: 2026/07/21 18:38

# Nvidia 想掌控 AI 数据中心里的每一块芯片 来源:https://www.wired.com/story/nvidia-wants-to-own-every-chip-inside-an-ai-data-center/ 本周,Nvidia 正在大力宣传其新款 Vera Rubin 芯片系统,在竞争对手 AMD 于周四旧金山举行年度产品活动之前,公布了该 GPU 和 CPU 组合的新性能基准(https://www.wired.com/story/nvidias-rubin-chips-are-going-into-production/)。 上周,在加州圣克拉拉公司总部举行的一场冗长的技术研讨会上,Nvidia 高管向一小群记者吹嘘了该芯片系统增强的性能和效率。最重要的信息是:长期专注于制造 GPU 的 Nvidia,正越来越多地试图将自己定位为能够驱动 AI 代理的 CPU 供应商。 虽然 GPU 仍然是公司用于训练和运行 AI 模型的主要硬件(https://www.wired.com/story/ai-could-democratize-one-of-techs-most-valuable-resources/),但行业向更复杂、基于代理的系统转变,增加了对 CPU 的需求,因为 CPU 可以协调数据流、网络和其他软件任务。这可能是 Nvidia 渴望将自己推广为完整 AI 系统(而不仅仅是 AI 芯片)供应商的原因之一。 Vera Rubin 是 Nvidia 对其混合超级芯片系统 Grace Blackwell(https://www.wired.com/story/nvidias-deal-with-meta-signals-a-new-era-in-computing-power/)的继任者,代表着其在短期内为 AI 行业提供动力的关键。它的设计是每两个 GPU 配一个 CPU。在一个 Vera Rubin NVL 72 超级芯片系统中,有 36 个 Vera CPU 对应 72 个 Rubin GPU。Nvidia 也单独销售 Vera CPU,据报道已告知中国客户(https://www.reuters.com/world/china/nvidia-begins-vera-cpu-sales-pitch-chinese-clients-sources-say-2026-06-12/)这些产品最早可能在 8 月准备就绪。 (图片可能包含:电子硬件、计算机硬件、印刷电路板、记分牌和计算机.jpg) Nvidia 为其新 Vera Rubin 硬件系统使用的 CPU 芯片。 图片由 Nvidia 提供 Nvidia 高管强调,其新的 Vera Rubin NVL72 机架(将大量芯片封装在一个液冷平台中)比其早期的一些产品更具“即插即用”特性。在硅谷 Nvidia 数据中心实验室的短暂参观中,Nvidia 高管透露 OpenAI 已经有一个 Vera Rubin 机架在使用中。 Nvidia 首席执行官黄仁勋上周没有出现在圣克拉拉的研讨会上;他当时在日本宣布这家芯片制造商与多家日本企业建立新合作关系(https://www.reuters.com/business/media-telecom/nvidia-partners-with-japan-robotics-firms-ai-development-2026-07-16/),以开发用于机器人技术的 AI。简报会由 Nvidia 长期担任加速计算副总裁、也是公司 CUDA 软件架构师的 Ian Buck 主持。 “我们有一条路线图,要推出新的架构,不仅是 GPU,还有 CPU,”巴克告诉记者。“我们将持续创新,因为在硅谷,不这样做就灭亡。” 会议在黄仁勋的高管简报中心举行,Nvidia 发言人告诉 WIRED,附近多张桌子上堆满了黄仁勋最近从台北 Computex(一个大型年度半导体贸易展)带回来的台湾零食袋。 (图片可能包含:电子硬件、计算机、计算机硬件和服务器.jpg) 一个装有 Nvidia Vera CPU 的机架,这些 CPU 旨在与公司的下一代 Rubin GPU 配对用于 AI 数据中心。 图片由 Nvidia 提供 Nvidia 声称,Vera Rubin NVL72 系统处理每瓦特 token 数将是其 Grace Blackwell 超级芯片的 10 倍。该公司表示,其 Vera CPU 在处理代理型 AI 任务方面比 AMD 和 Intel 的竞品 CPU 更快(尽管用于支持这些基准测试的测试似乎使用了竞争对手稍旧一代的 CPU)。新芯片上的本地内存子系统还将提供比 Blackwell 高出近三倍的内存带宽,在当前高带宽内存持续短缺(https://www.wired.com/story/we-are-in-the-knockout-round-of-price-increases-for-consumer-electronics/)的情况下,这对许多公司来说可能是一个有吸引力的特性。 Nvidia 表示,它还大幅减少了在多机架服务器系统中将芯片连接到机架所需的电缆数量,以至于公司宣称 Vera Rubin 实现了“无电缆计算”和“热插拔”。这意味着客户理论上可以将每个机架的安装时间从几个小时减少到几分钟,这一点由 Buck 和 Nvidia 硬件工程高级副总裁 Andrew Bell 共同提出。新芯片系统完全采用液冷,这可以减少冷却芯片所需的能量,因为风冷更耗能。 自 2025 年春季 Nvidia 发布 Vera Rubin 以来,公司一直在慢慢透露更多关于该芯片系统的细节,同时坚持其将按时发布。黄仁勋多次表示 Vera Rubin 正在“全面投产”,并将在今年下半年出货,早期客户包括微软、OpenAI 和甲骨文。 Nvidia 对任何关于延迟的暗示都特别敏感,此前其上一代 Blackwell 芯片据报道在公司的定制服务器机架中连接时出现过热问题,迫使公司进行设计更改并推迟发货。 Nvidia 对 Vera Rubin 的营销推广恰逢竞争对手 AMD 的年度会议之前,预计高管们将在会上宣传其下一代 AI 和数据中心芯片。周日,AMD 透露了更多关于其 Helios AI 芯片机架的细节(https://www.cnbc.com/2026/07/20/amd-helios-microsoft-ai-nvidia.html),该机架旨在与 Nvidia 的新产品竞争。AMD 和 Nvidia 都在争夺大规模、多年期的合同(https://www.wired.com/story/nvidias-deal-with-meta-signals-a-new-era-in-computing-power/),以便向像 Meta 和 Amazon 这样的 AI 超级云服务商以及像 OpenAI、Anthropic 和 SpaceXAI 这样的 AI 实验室供应芯片。 过去两年,AMD 在数据中心所用 CPU 市场的份额大幅增长(https://www.wired.com/story/lisa-su-runs-amd-and-is-out-for-nvidias-blood/)。该公司长期被视为现代 x86 处理器芯片架构的先驱,而 x86 处理器仍然占据数据中心 CPU 收入的绝大部分。相比之下,Nvidia 在其数据中心 CPU 上采用的是 ARM 架构,这是一种以能效著称的替代性芯片架构。 Nvidia 高管 Buck 和负责 CPU 产品营销的 Hannah Coutand 都强调,Vera Rubin 摒弃了许多现代处理器使用的芯片架构,转而采用单一的单片芯片。Coutand 认为,将多个小芯片拼接在一起会对“内存带宽和数据移动施加沉重的代价”,而 Vera Rubin 的单片设计允许数据在单个集成电路上更快地移动。

相似文章

NVIDIA刚刚发布了全新的Vera CPU——据称比x86快两倍

Reddit r/ArtificialInteligence

NVIDIA宣布了采用全新Vera架构的CPU,该架构从头开始为智能代理AI和强化学习而设计,声称性能达到x86替代方案的两倍。Vera Rubin NVL72平台集成了72个GPU和36个CPU,主要客户包括Meta、Oracle和Alibaba。