资讯

内存成本高企!英伟达Rubin Ultra减配:HBM从12层砍至8层

驱动之家·2026/9/9 07:57:00🔗 原文

📋总体概括

据SemiAnalysis分析,受存储成本高企影响,英伟达考虑将下一代Rubin Ultra加速器的HBM方案从12层堆叠调整为8层。8层HBM4下单颗GPU显存约192GB,较12层方案的288GB减少约三分之一,但在2048位接口和引脚速率不变下总带宽可维持甚至小幅提升,单位容量对应带宽提升约50%。当前Rubin GPU采用12层HBM4,提供288GB显存和22TB/s带宽。三星与SK海力士计划2026年下半年提高8层HBM4供应比例。此举反映行业约束从单位容量成本转向单位带宽成本,散热、封装良率与供应灵活性成为新竞争维度。

关键信息

  • 英伟达考虑将Rubin Ultra的HBM从12层砍至8层,单颗显存或从288GB降至约192GB,减少三分之一
  • 8层方案在2048位接口下可维持甚至小幅提升总带宽,单位容量对应带宽提升约50%
  • 行业关键约束已从「单位容量成本」转向「单位带宽成本」,英伟达更重系统经济性
  • 三星和SK海力士计划2026年下半年提高8层HBM4供应比例,供应链已跟进调整
  • 更高层数堆叠对键合封装、散热和良率提出更高挑战,8层方案便于平衡供应灵活性

🔥犀利点评

内存涨价的连锁反应终于砸到英伟达头上了——砍显存还能包装成「单位带宽成本优化」,这波操作确实精明:带宽不变、容量缩水、成本下降,客户买单还觉得赚了。但说白了就是存储卡脖子逼出来的妥协,显存容量对大模型推理的影响被轻描淡写了。真正值得警惕的是HBM供应商:竞争维度从堆层数军备赛转向良率和成本控制,三星翻身的机会可能就藏在这。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文