英伟达Rubin Ultra减配HBM,存储承压,利好互联?



原创

南京老张
南京老张



雪比特





2026年8月3日 22:41
浙江
13人








在小说阅读器读本章






去阅读










在小说阅读器中沉浸阅读








本文观点来自券商,不代表投资建议。

周末海外博主说的 HBM 减配,是周三SemiAnalysis的一篇机构客户报告《Rubin Ultra HBM to 192GB》 ---- 根据行业传闻,Rubin "Ultra"正在向主要客户进行预览,其规格低于此前预期。主流的Rubin Ultra SKU将保持相同的理论峰值FLOPs,仍采用HBM4,但规格降至8-Hi 192GB,低于288GB 12-Hi的Rubin。内存带宽略有提升,芯片级功耗约为1,800W,与初始Rubin出货版本的功耗相同,但低于2,300W的双盖板版本。这意味着在当前路线图上,Rubin Ultra的唯一升级是NVL576规模的扩展域世界尺寸。实现NVL576的其中一个计划系统形态是8组72 GPU机架互联,采用NPO用于交换机到交换机的机架间连接。一如既往,Nvidia拥有多条开发轨道,但我们认为该形态被视为最有希望的候选方案。


说Rubin Ultra存储降配,从HBM4E 12‑Hi 384GB变成了 HBM4 8‑Hi 192GB。Rubin ultra最核心的升级是scale up从NVL72扩大到NVL576,机架间的交换机连接采用NPO互联。 

按照SemiAnalysis的测算: 因为HBM涨价,Rubin ultra rack BOM从660万美元提升到800万美元; 降配后,Rubin ultra BOM成本回到约640万美元。 省下来的成本用于增加switch tray和scale‑up互联。 

从成本结构也能看出显著的变化: HBM从28%降低到14%; 内存成本从40%下降到28%; Scale up互联成本从4%提升到12%; scale out从14%提升到16%。 一边是内存成本占比下降12%,一边是互联总成本占比提升10%。 典型的存储不够,互联来凑。 

英伟达做出上述降级和调整,主要是在晶圆紧张和电力稀缺的约束背景下,不再过度追求极致单卡性能,转而部署更大的系统集群并获得更高的整体。 我认为这种可能性是比较高的,因为当存储占机柜成本高达50%,下游终端不可能容忍这种现象,长协、减配、技术升级都是必选项。 对英伟达来说,与其资本开支都流入存储口袋,不如减配存储,转而生产更多GPU和光互联,这些既能降低BOM,又能最大化自身利益,GPU和互联都是英伟达的核心业务,这些赚钱都流入自己口袋。

实际上不仅仅是英伟达这么搞,AMD也在做同样的事情,谷歌估计也不会例外,因为存储BOM占比太高了,必须降配和优化,把预算投到更高回报的系统环节。 


按照SA的说法: Rubin ultra NVL576或采用8个Oberon的NVL72机柜,柜间走scale‑up光互联,组合新 NVL576超节点。 硬件增量为柜内Switch tray容量翻倍,搭配 3.2T NPO引擎用作柜间 scale‑up 互联。 若采用 dragonfly 组网,则Rubin ultra:3.2T NPO=1:4,带来纯增量的市场空间,利好网络侧通胀,资本开支占比提升,对大光是全新的增量市场,基本跟前面英伟达千万级别的NPO需求对上了。

完整SemiAnalysis报告及更多实时行业资讯可参考知识星球

追加内容

本文作者可以追加内容哦 !