1TB显存砍到192GB,NVIDIA也被AI榨干了?

没想到有一天,NVIDIA 自己也得对显存动刀了。

据 The Information 消息,NVIDIA 正在重新测试下一代 Rubin Ultra AI GPU 的显存配置。
原本规划的 1TB HBM4E,现在出现了 256GB,甚至最低只有 192GB 的测试方案,部分版本连 HBM4E 都可能不用,退回普通 HBM4。
图片
集邦咨询 8 月初也报道过,NVIDIA 正在测试 8-Hi HBM4E、12-Hi HBM4、8-Hi HBM4 等不同组合,最终规格还没有确定。
虽然这代表着 Rubin Ultra 有多重方案评估,但和 NVIDIA 最初画出来的饼相比,这个落差确实有点大。
图片
今年 3 月老黄在 GTC 上展示的 Rubin Ultra,原计划采用四颗计算 Chiplet,周围塞下 16 组 HBM4E,总容量直接拉到1TB,未来用于 Kyber 系列机架。
图片
作为对比,今年开始出货的普通 Rubin GPU 就已经提供 288GB HBM4,单颗 GPU 的 NVFP4 推理性能达到 50 PFLOPS。
图片
结果到了更高一级的 Ultra,反而开始测试 192GB。多少有点开倒车的意思了。
图片
原因嘛,也很简单。集邦咨询判断,整个 DRAM 市场到 2027 年依旧会比较紧张,而 HBM 又是现在 AI 芯片最抢手的资源之一。
Rubin Ultra 原计划用的 12-Hi HBM4E,目前还面临验证周期和量产良率的问题。HBM4E 本身也比之前的产品复杂不少。
图片
再加上 Rubin Ultra 一颗GPU 就准备挂 16 组 HBM,到了大规模量产阶段,对晶圆、封装和良率的要求都更高。
NVIDIA 这边也回应:他们会在计算、网络和内存之间重新做平衡,目的就是生产更多 GPU、部署更多 AI 系统。
图片
中译中的意思是 HBM 就这么多。一颗卡塞 1TB 固然猛,但如果因此少造一堆 GPU,那对现在的 NVIDIA 来说未必划算。
不过降低单机显存后,有更多的企业买得起,反而提振了需求,增加了订单量,显存消耗也会越多。
图片

也就是「显存越少,显存越多」。
图片
集邦咨询也预测 2027 年 HBM 的出货量还会同比增加 50%-60%,SK 海力士 CEO 7 月接受 Reuters 采访时说得更夸张:
预计 2027 年会成为存储行业有史以来供应最紧张的一年,即使各家继续扩产,客户需求高于供应能力的情况,也可能延续到 2030 年以后。
图片
看到这可能有同学要说了,那 HBM 咱们普通人也用不上啊,再缺货跟我有啥关系。
除了 HBM,Vera Rubin上的 CPU 用的 SOCAMM2 的内存也不太够用,而它是基于 LPDDR5X 的服务器内存模块。
图片
集邦咨询 8 月的报告显示,因为 LPDDR5X 供应紧张预计会持续到 2027 年,NVIDIA 已经决定把下一代 Vera Rubin Superchip 使用的 SOCAMM 容量直接砍半。
图片
此前规划的是单条 192GB,现在有消息称可能降到 96GB;算到整套 Vera Rubin NVL72 机架里,CPU 侧内存也会从大约 55TB 降到 28TB。
从这一点看,AI 对内存资源的争夺,在消费级领域手也伸得够长。
不过嘛,Rubin Ultra 突然开始测试低显存版本,究竟真的是因为 HBM 不够,老黄想一颗少塞点、腾出产能造更多 GPU;还是因为 1TB 这种顶配实在太贵、能买单的客户没想象中那么多,所以不得不往下做“阉割版”拓宽市场?
这个现在谁也说不好。
图片
而且最近 NVIDIA 在OpenAI 身上,也开始算得更细了。
此前外媒报道称,NVIDIA 一度考虑为 OpenAI 俄亥俄州的数据中心项目提供最高 2500 亿美元担保。
图片
所谓担保,简单说就是 OpenAI 如果租不起、项目出了问题,NVIDIA 要替它兜一部分底。
最新的一集,这个数字目前一路缩到了最高约 1050 亿美元。
图片
项目倒没有取消,OpenAI 还是继续建,NVIDIA 也继续给它供芯片。只是这些调整倒是很耐人寻味。
不过对于咱们而言,AI 对消费端的产能还是有挤占,咱们依旧得跟着承受压力。
图片
至于显卡和内存什么时候重新便宜下来……
至少现在看,AI 还没打算给消费市场让桌。
数据素材来源:路透社、集邦咨询、The Information、NVIDIA,部分图源网络。


本文编辑:@ 阿红

©本文著作权归电手所有,未经电手许可,不得转载使用。