标签
NVIDIA 与 CoreWeave 正在 CoreWeave Cloud 上将 Vera Rubin NVL72 系统投入生产,Devin AI 的开发商 Cognition 成为首个生产客户,报告称在软件工程推理工作负载上 token 吞吐量最高提升 4.8 倍。CoreWeave 还推出了 CoreWeave Forge,并将提供 NVIDIA Vera CPU——号称首款专为 AI 智能体打造的 CPU。
文章质疑 Nvidia 的 Vera Rubin 是否会加速 LLM 预训练,并探讨了考虑到数据、电力和成本等限制,超过 10 万亿参数的模型是否可行。
NVIDIA 的 Vera Rubin NVL72 系统在 MLPerf Inference v6.1 中首次亮相,展现出领先性能。在 DeepSeek-R1 和 Qwen3-VL 等基准测试中,其吞吐量比 GB300 NVL72 最高提升达 3.7 倍。该系统强调系统性能、扩展效率以及软件优化。
Figure.AI与Nscale合作,计划到2027年部署多达100,000个NVIDIA Vera Rubin GPU,初始投资为35亿美元,以推进面向家用的通用人形机器人。
SpaceX 和 Nvidia 正在将 Vera Rubin NVL72 AI 平台适配用于轨道应用,并计划于2027年第四季度作为 Starmind AI 卫星项目的一部分发射一个空间优化系统。
NVIDIA预计2027财年第三季度Vera Rubin系统的销售额将达到200亿美元,这标志着其历史上最快的产品爬坡速度,首批出货将面向Microsoft等主要超大规模客户。
NVIDIA报告称,与GB300相比,Vera Rubin的每兆瓦智能体吞吐量最高提升30倍,但强调生产基准测试应包含超越每瓦令牌数的额外指标。
NVIDIA已开始全面生产Groq 3 LPX AI推理加速芯片,该芯片为Vera Rubin平台提供支持,实现了AI模型有史以来最快的令牌生成速度。
Satya Nadella 宣布首批量产 NVIDIA Vera Rubin 芯片抵达 Microsoft 数据中心,感谢合作伙伴和团队为此里程碑所付出的努力。
IneffableLabs收到了来自Google Cloud和NVIDIA的首批Vera Rubin NVL72集群,标志着AI硬件的飞跃。
NVIDIA宣布Vera Rubin平台,每兆瓦吞吐量比Blackwell提升10倍,并通过跨越七颗芯片和五个机架托盘的极致协同设计,为AI工厂提供最低的代币成本。
Nvidia 正推广其新的 Vera Rubin 芯片系统,该系统结合了 GPU 和 CPU,旨在为数据中心提供完整的 AI 系统;OpenAI 已在使用一台机架。
百时美施贵宝正在部署其第二个基于 DGX Vera Rubin NVL72 系统的 NVIDIA DGX SuperPOD,打造生命科学领域最强大的 AI 集群,以加速药物发现,让所有科学家都能使用 AI。
NVIDIA 推出了 Vera Rubin,这是一种新架构,旨在最大化训练后工作负载的每美元智能,通过优化每 Token 成本和支持大规模强化学习,满足代理式AI的持续学习需求。
Nvidia与SK海力士已签署下一代HBM4内存的多年期技术合作协议,同时Nvidia的Vera Rubin AI平台进入生产阶段,代理吞吐量提升10倍,将于第三季度向主要云服务商发货。
在 Nvidia GTC 2026 上,CEO 黄仁勋发布了下一代 Vera Rubin 系统;Supermicro 也推出基于 Nvidia Blackwell GPU 的全栈 AI Factory 产品组合,实现企业级 AI 一站式部署。