英伟达拟降Rubin Ultra显存配置应对HBM短缺
据The Information报道,英伟达正评估为下一代AI GPU Rubin Ultra推出低于原计划显存配置的版本,以缓解高端HBM供应不足带来的量产压力。知情人士透露,英伟达已测试至少三个不同版本,部分采用较低显存容量。此举可能推高AI服务器成本,影响微软、Meta等云厂商的数据中心建设预算。HBM供应已成为AI产业链关键瓶颈,业内预计未来数年仍将供不应求。
据The Information报道,英伟达正评估一项调整方案,计划为下一代AI GPU Rubin Ultra推出低于原计划显存配置的版本,以缓解高端高带宽内存(HBM)供应不足带来的量产压力。知情人士透露,过去数周,英伟达已测试至少三个不同版本的Rubin Ultra GPU,其中部分版本采用了低于最初规划的显存容量。Rubin Ultra是英伟达下一代AI计算平台的重要组成部分,定位高于即将量产的Rubin系列,原计划搭载容量更高、带宽更大的HBM以提升模型训练和推理性能。
在HBM供应持续偏紧的背景下,英伟达正重新评估产品配置,希望通过调整显存规格保证产品按计划上市。对于AI训练而言,HBM不仅决定GPU的数据吞吐能力,更直接影响能够容纳的大模型规模。如果Rubin Ultra最终采用较低显存配置,客户在运行大语言模型等大型AI工作负载时可能需要部署更多GPU,从而推高系统部署成本和集群复杂度。对于微软、Meta、亚马逊、谷歌等持续扩大AI资本开支的大型云厂商而言,这意味着未来数据中心建设成本可能进一步上升。
HBM已成为当前AI产业链最紧缺的核心零部件之一。大模型训练需求快速增长使GPU出货量持续攀升,而GPU所需的HBM主要由三星电子、SK海力士和美光等少数厂商供应。由于HBM制造工艺复杂、良率要求高、扩产周期长,供应增长速度难以追赶AI需求。业内普遍预计,未来数年HBM仍将维持供不应求状态,这也是AI服务器价格居高不下的重要原因之一。
HBM价格上涨的影响已不仅局限于AI服务器,随着GPU、HBM等关键元器件持续紧缺,整个科技行业的硬件成本均受到推升。上游芯片成本上涨也开始向消费电子领域传导,包括苹果在内的部分硬件厂商已通过提高终端产品售价等方式消化供应链成本压力。市场人士认为,只要AI算力需求继续高速增长,而HBM新增产能释放速度有限,围绕高端存储资源的竞争仍将持续,HBM供应能力将继续成为决定AI产业扩张速度的关键因素。
为什么重要英伟达调整旗舰GPU配置,反映HBM供应瓶颈对AI产业链的制约,影响美股科技股及云厂商资本开支预期。