受高昂的内存价格及持续紧张的供应链形势影响,英伟达(NVIDIA)正计划大幅调降其下一代Vera Rubin NV72(特别是VR200 NVL72)机柜级人工智能(AI)系统的内存配置。
根据广发证券(GF Securities)发布的最新分析报告,这一举措旨在应对高带宽内存(HBM4)与LPDDR5X等关键组件价格剧烈上涨所带来的成本压力。此前,虽然英伟达在行业出现大范围内存短缺前已签署了长期供应协议,较好地抵御了供需失衡的冲击,但日益高企的组件成本依然迫使该公司做出规格调整。

英伟达的Vera Rubin NVL72机柜被视为目前全球性能最强悍的AI系统之一。该系统于今年1月首次对外公布,随后在云服务提供商CoreWeave公布的测试数据中展示出了惊人的算力表现。在混合专家模型(MoE)工作负载下,上一代采用Blackwell AI GPU的系统在150兆瓦功耗下可实现每秒8万个Token的吞吐量,而全新的VR200 NVL72 Vera Rubin平台则将这一数字直接提升了10倍,达到了每秒80万个Token。
然而,极其强劲的性能也伴随着昂贵的硬件成本。投资研究机构伯恩斯坦(Bernstein)此前发布报告称,受内存价格飙升推动,单台NVL72 Rubin机柜的实际造价可能高达910万美元,远超此前行业基于早期内存报价估算的780万美元。伯恩斯坦进一步预测,到2027年,下一代HBM4内存的价格可能会飙升至每GB 53美元。
面对内存市场的供给瓶颈与高企成本,广发证券的分析报告指出,英伟达正通过削减规格来主动应对挑战。在VR200 NVL72机柜中,英伟达计划将默认配备的SOCAMM(小型压接附加内存模块)规格削减一半,从原先的192GB模块降至96GB模块,以此来缓解LPDDR5X供应链的压力。此外,Vera CPU端的整体内存容量也将从原本规划的54TB至55TB大幅调降至约28TB,每个CPU同样将采用96GB的SOCAMM模块。而在GPU方面,每台机柜仍将维持使用20.7TB的HBM4高带宽内存。

从财务角度来看,规格调降将显著降低系统组件的物料成本(BOM)。广发证券表示,如果将LPDDR5X内存容量减半,VR200相关的LPDDR5X成本可从原先估算的120万美元下降至58.6万美元;若容量进一步削减至原来的四分之一,成本甚至可降至29.3万美元。据分析,如果不做出上述规格调整,内存成本在VR200系统总物料成本中的占比将飙升至29%(约210万美元),远远超出了英伟达将内存成本控制在20%以内的理想水平。通过此番灵活精简配置,英伟达有望在保持高吞吐算力优势的同时,将机柜整体造价控制在合理区间。