288GB变192GB!12层HBM变8层

2026-09-10
阅读量 903

据闪德资讯获悉,有消息显示,英伟达计划将下一代Rubin Ultra AI加速器的HBM方案,由12层堆叠改为8层。在存储成本上行环境下,英伟达将重心转向单位带宽成本与整机经济性。

Inside NVIDIA Rubin GPU Architecture: Powering the Era of Agentic AI |  NVIDIA Technical Blog

SemiAnalysis分析,行业约束已经从单位容量成本转向单位带宽成本。采用8层HBM4后,Rubin Ultra单卡显存约192GB,相比原12层方案的288GB缩减三分之一。

HBM带宽由堆叠数量、接口与传输速率决定,并非垂直堆叠层数。在接口、堆叠数量不变前提下,8层方案可保留甚至小幅提升总带宽,单位容量带宽提升约50%。

该取舍适配AI推理场景。生成Token时,模型权重与KV缓存反复读取,内存带宽是性能瓶颈。大容量显存利于承载大模型与长上下文,但单纯增加堆叠层数无法提升带宽。

当前Rubin GPU采用12层HBM4,单卡288GB显存、22TB/s带宽。Rubin Ultra的改动,代表英伟达优先选择性价比更高的带宽供给。

供应链随之调整,三星、SK海力士计划2026下半年提升8层HBM4供货占比。英伟达已推动供应商,将部分HBM4产能从12层转向8层。

这标志AI芯片设计思路发生变化:不再一味追求显存容量,带宽与系统成本的平衡成为新的优先考量。

点击此处关注获取最新资讯!

f328f6db93164f84bb23c090c28e7db.png88c1a0acd98aa6023fcbfa1f2ebf421.png




1.本文整理自网络,如有侵权,请联系删除。

2.所刊内容仅代表作者观点,非闪德资讯立场。

我的评论

登录后评论

最新评论

渠道报价
查看更多

D4/32G-D4 3200

  • 一年
  • 半年
  • 三个月
  • 一个月

微信订阅

APP下载

存储未来,赢得先机

18126200184

Copyright©2008-2026 闪德资讯 版权所有 粤ICP备18080549号-1

粤公网安备 44030402002744号