据报道,英伟达因内存短缺加剧正在测试Rubin Ultra的较低内存配置——测试设计包括低至192 GB并退回HBM4
摘要
据报道,由于HBM供应紧张,英伟达正在测试其即将推出的Rubin Ultra加速器的低内存版本,包括192 GB或256 GB的配置,并从HBM4E切换至HBM4。
暂无内容
查看缓存全文
缓存时间: 2026/08/11 05:33
# 英伟达据报道正在测试内存配置更低的 Rubin Ultra,内存短缺问题再度来袭 —— 测试的设计包含低至 192 GB 的版本,并回退至 HBM4
来源:https://www.tomshardware.com/pc-components/gpus/nvidia-reportedly-testing-lower-memory-configs-of-rubin-ultra-as-memory-shortage-bites-back-designs-tested-include-as-little-as-192-gb-and-step-back-to-hbm4
英伟达 CEO 在 GTC 2026 上展示 Rubin Ultra。\(图片来源:英伟达\)
据报道,英伟达正在测试其即将推出的 Rubin Ultra 加速器的不同内存版本,原因在于担心无法获得足够的 HBM。根据《The Information》的报道,一些版本仅配备 192 GB 内存,并使用 HBM4 而非最初公布的 HBM4E。(https://go.redirectingat.com/?id=92X1584492&xcust=tomshardware_us_8663936084704061225&xs=1&url=https%3A%2F%2Fwww.theinformation.com%2Farticles%2Fnvidia-weighs-radical-idea-less-rubin-ultra-chip-memory%3Futm_campaign%3DEditorial%26utm_content%3DArticle%26utm_medium%3Dorganic_social%26utm_source%3Dbluesky%252Cthreads%252Ctwitter&sref=https%3A%2F%2Fwww.tomshardware.com) 该报道证实了此前分析公司 SemiAnalysis 关于 Rubin Ultra 可能降低内存规格的评论。
通过 TH Premium 了解更多:内存
我们最早在今年的 GTC 上亲眼见到了 Rubin Ultra (https://www.tomshardware.com/pc-components/gpus/nvidia-demonstrates-rubin-ultra-tray-worlds-1st-ai-gpu-with-1tb-of-hbm4e),当时英伟达展示了一个计算托盘,内含四个计算小芯片以及 1 TB 的 HBM4E 内存。该加速器是英伟达 Kyber NVL144 设计的一部分,计划于 2027 年推出。SemiAnalysis 曾报道 (https://www.tomshardware.com/pc-components/gpus/nvidias-kyber-rack-for-rubin-ultra-slips-to-2028) 该机架已推迟至 2028 年。英伟达回应《Tom's Hardware》称:“我们的路线图保持不变。”但公司并未澄清该延期是否属实。我们已就这份最新报道联系了英伟达。
根据《The Information》的报道,英伟达正在测试配备 192 GB 或 256 GB 内存的 Rubin Ultra 版本,以及使用少于公布的 16 个内存堆栈的版本。也许最重要的是,据报道英伟达正在测试使用 HBM4,而非最初公布的 HBM4E。除了每一代新 HBM 都有的传统性能提升外,HBM4E 的独特之处在于它提供了可定制的基底逻辑芯片。去年,美光宣布与台积电建立合作伙伴关系 (https://www.tomshardware.com/micron-hands-tsmc-the-keys-to-hbm4e),以制造基底芯片,并允许客户根据需求调整逻辑芯片。
据报道,HBM4E 的复杂性给供应带来了压力,内存制造商无法跟上 Rubin Ultra 的推出节奏。该报道称,英伟达至少测试了三种低内存设计,但我们尚未完全了解这些原型的全部细节。报道称测试涉及 HBM4,以及 192 GB 和 256 GB 配置,但未提及计算芯片的数量,也未说明每种测试容量所使用的内存类型。
芯片数量很重要。6 月份,有报道称英伟达因制造复杂性而取消了 (https://www.tomshardware.com/tech-industry/artificial-intelligence/nvidia-reportedly-cancels-quad-die-rubin-ultra-gpu-in-favor-of-dual-gpu-design-report-claims-complex-design-purportedly-scrapped-over-manufacturing-execution-concerns) 其四芯片 Rubin Ultra 设计。尽管英伟达尚未置评,但当时有报道暗示英伟达将推进双 GPU 的 Rubin Ultra。在这种情况下,减少内存配置会更有意义。即使是双芯片 Rubin Ultra,上述的容量也低于预期。目前每颗基础版 Rubin GPU 配备 288 GB 的 HBM4。
很明显,英伟达正试图在内存领域未雨绸缪,而当前的内存供应协议已签署到未来数年。英伟达自己也有多项协议。6 月份,该公司宣布与 SK 海力士达成合作伙伴关系 (https://www.tomshardware.com/pc-components/dram/nvidia-and-sk-hynix-ink-multi-year-memory-co-development-and-supply-agreement-seeks-to-address-extended-development-cycles),共同开发下一代内存技术,其中包括 HBM,但也包括 LPDDR5X 和 DDR5。7 月份,英伟达通过一项价值 5000 亿美元的战略合作关系 (https://www.tomshardware.com/pc-components/dram/nvidia-and-sk-hynix-ink-multi-year-memory-co-development-and-supply-agreement-seeks-to-address-extended-development-cycles) 扩大了该合作伙伴关系,其中包括与 SK 的长期内存供应协议。
尽管英伟达正在考虑更低内存的配置,但一位英伟达客户告诉《The Information》,每颗 GPU 的内存并不是首要关注点,他们更看重与英伟达的长期合作关系。
获取 Tom's Hardware 最新的最佳新闻和深度评测,直接发送到您的收件箱。
内存短缺正影响着目前市场上的几乎所有设计,而搭载 HBM 的企业级系统尤其脆弱。上周,Digitimes 报道 (https://www.digitimes.com.tw/tech/dt/n/shwnws.asp?CnlID=1&id=0000763847_DVY7YHX65GMLYZ6UQEEMP) 三星、SK 海力士和美光的 HBM 产能已售罄至 2027 年。上个月,SK 海力士 CEO 郭鲁正 (Kwak Noh-jung) 表示,2027 年将是内存短缺“最严重的一年” (https://www.tomshardware.com/pc-components/dram/sk-hynix-says-2027-will-be-the-worst-year-for-memory-shortage-forecasts-crunch-to-last-until-2030-ceo-shares-grim-outlook-on-the-day-sk-hynix-gets-listed-on-nasdaq),供应紧张将持续到 2030 年。
Google 首选来源 (https://news.google.com/publications/CAAqLAgKIiZDQklTRmdnTWFoSUtFSFJ2YlhOb1lYSmtkMkZ5WlM1amIyMG9BQVAB) 在 Google News 上关注《Tom's Hardware》(https://news.google.com/publications/CAAqLAgKIiZDQklTRmdnTWFoSUtFSFJ2YlhOb1lYSmtkMkZ5WlM1amIyMG9BQVAB),或将其添加为首选来源 (https://google.com/preferences/source?q=),即可在您的信息流中获取我们的最新新闻、分析和评测。
Jake Roach 是 Tom's Hardware 的高级 CPU 分析师,负责撰写有关最新消费级和工作站处理器的评测、新闻和专题文章。
相似文章
Nvidia与SK海力士签署多年期AI合作协议 迎接Vera Rubin发布
Nvidia与SK海力士已签署下一代HBM4内存的多年期技术合作协议,同时Nvidia的Vera Rubin AI平台进入生产阶段,代理吞吐量提升10倍,将于第三季度向主要云服务商发货。
70级显存停滞不前
作者观察到Nvidia桌面级70系列GPU已经连续两代停留在12GB显存,并暗示Nvidia可能是故意限制显存,以维持对利润率更高的AI硬件需求的增长。
Nvidia RTX 5090 配备 96GB 显存
一款中国改装版 Nvidia RTX 5090 配备 96GB 显存,在阿里巴巴上以低于4000美元的价格出售,提供三倍显存,成本仅为原价的65%。
谁承担内存成本?(9分钟阅读)
本文分析了HBM内存成本上升如何影响NVIDIA的AI服务器定价和毛利率,暗示客户可能需要承担如Vera Rubin和Grace Blackwell等即将推出系统的额外成本。
NVIDIA NVLink Fusion 通过 NVHBM 定制高带宽内存进行扩展
NVIDIA 通过 NVHBM 定制高带宽内存技术扩展 NVLink Fusion,该技术提升了 AI 工作负载的内存性能与效率,并与 AWS 的 Annapurna Labs 作为早期合作伙伴进行协作。