报道:英伟达拟下调Rubin Ultra显存配置,应对高端HBM短缺
这意味着客户未来可能需要部署更多GPU才能完成同等算力任务,微软、Meta、谷歌等科技巨头的数据中心建设成本或将进一步攀升。
AI基础设施热潮正在逼近供应链极限。
据The Information报道,英伟达正评估一项颇为激进的调整方案——为下一代AI GPU Rubin Ultra推出低于原计划显存配置的版本,以缓解高端高带宽内存(HBM)供应不足带来的量产压力。
这意味着,即便是掌握GPU市场主导权的英伟达,也不得不在产品规格与供应能力之间寻求平衡。
这一变化不仅反映出HBM供应已成为AI产业链最关键的瓶颈之一,也意味着AI服务器成本或进一步攀升,数据中心建设压力仍将持续向下游传导。
周四英伟达股价收跌0.1%,SK海力士股价收跌4.97%。


HBM供应紧张,英伟达测试多个"降显存"版本
知情人士透露,过去数周,英伟达已经测试至少三个不同版本的Rubin Ultra GPU,其中部分版本采用了低于最初规划的显存容量。
英伟达考虑推出低显存版本,一个重要原因在于未来可能无法获得足够数量的高端HBM芯片,以支撑原始设计的大规模量产。
Rubin Ultra是英伟达下一代AI计算平台的重要组成部分,定位高于即将量产的Rubin系列,被视为未来训练超大规模AI模型的重要硬件平台。按照原有规划,其将搭载容量更高、带宽更大的HBM,以进一步提升模型训练和推理性能。
不过,在HBM供应持续偏紧的背景下,英伟达正在重新评估产品配置,希望通过调整显存规格保证产品按计划上市,而不是继续等待供应链扩产。
显存减少意味着需要部署更多GPU
对于AI训练而言,HBM不仅决定GPU的数据吞吐能力,更直接影响能够容纳的大模型规模。
如果Rubin Ultra最终采用较低显存配置,在运行大语言模型等大型AI工作负载时,客户可能需要部署更多GPU,才能完成原本由较少芯片即可完成的计算任务。
虽然英伟达仍可通过提高GPU计算能力、优化互连带宽等方式部分弥补性能损失,但总体来看,系统部署成本和集群复杂度仍可能有所提高。
对于微软、Meta、亚马逊、谷歌等持续扩大AI资本开支的大型云厂商而言,这意味着未来数据中心建设成本可能进一步上升。
AI热潮暴露产业链最大瓶颈
HBM已经成为当前AI产业链最紧缺的核心零部件之一。
近年来,大模型训练需求快速增长,使GPU出货量持续攀升,而GPU所需的HBM主要由三星电子、SK海力士和美光等少数厂商供应。由于HBM制造工艺复杂、良率要求高、扩产周期长,供应增长速度始终难以追赶AI需求。
业内普遍预计,未来数年HBM仍将维持供不应求状态,这也是AI服务器价格居高不下的重要原因之一。
此次英伟达主动考虑降低Rubin Ultra显存配置,也反映出即便拥有产业链最强议价能力,其产品规划依然受到HBM供应约束。
成本压力向整个科技行业蔓延
HBM价格上涨带来的影响已经不仅局限于AI服务器。
随着GPU、HBM等关键元器件持续紧缺,整个科技行业的硬件成本均受到推升。企业采购AI基础设施的预算不断增加,越来越多公司不得不提高资本支出,以满足生成式AI部署需求。
与此同时,上游芯片成本上涨也开始向消费电子领域传导。包括苹果在内的部分硬件厂商,已经通过提高终端产品售价等方式消化供应链成本压力。
市场人士认为,只要AI算力需求继续高速增长,而HBM新增产能释放速度有限,围绕高端存储资源的竞争仍将持续,HBM供应能力也将继续成为决定AI产业扩张速度的关键因素。
免责声明:文章中的所有内容仅代表作者的观点,与本平台无关。用户不应以本文作为投资决策的参考。
你也可能喜欢
比特币巨鲸结束抛售,60天增持超27亿美元
据CryptoQuant,过去60天内,大型持币者净增持约4.3万枚比特币,按当前价格折算约合27.5亿美元。据Glassnode,持有100至1000枚比特币的中型持币者,以及持币超过1万枚的超大型投资者,近期也均呈现出买入加速态势。分析指出,市场真正意义上的复苏,仍需宏观经济环境的配合。
苹果向欧盟监管让步:取消核心技术费,欧洲App Store佣金全面下调
苹果宣布全面调整欧洲App Store商业规则,以化解与欧盟之间持久的竞争法纠纷。废除"以安装量计算的“核心技术费”机制,改为对平台外App内数字交易收取5%的佣金;将App内购佣金从30%降至26%,并允许开发者接入第三方支付。
数据中心反对声浪成美国中期选举敏感议题,宾州出台全美“最严格”数据中心监管规则
AI数据中心推升电价导致美国民众反对,已经成为美国中期选举的核心议题,为AI企业带来额外的风险。周二宾州出台监管,要求数据中心自行解决电力供应。美银指出,若共和党在11月中期选举中表现良好,将推动美股上涨;若民主党拿下参议院并赢得德州州长职位,美股明年跌幅可能超过10%。

