受全球高带宽内存短缺影响,英伟达正测试显存精简版下一代Rubin Ultra AI加速卡。重点评估的192GB配置比原版Rubin减少约三分之一,大幅低于最初设想,将直接重塑云端AI基础设施与采购规划。
全球高带宽内存(HBM)供应紧缺,正在打乱英伟达下一代 Rubin Ultra AI 加速卡的原定设计。英伟达目前正在测试削减显存容量的备选方案,其中重点评估的一套配置仅搭载约 192GB 片上显存。这一容量比现款 Rubin 芯片少约三分之一,更远低于该平台最初规划时设想的近 1TB 水平。

市场调研机构 TrendForce 在 8 月指出,英伟达已不再局限于最初规划的 12 层堆叠 HBM4E 方案,转而评估四种不同的显存组合:12-Hi HBM4E、8-Hi HBM4E、12-Hi HBM4 以及 8-Hi HBM4。目前量产规格尚未最终敲定。
行业分析机构 SemiAnalysis 指出,英伟达向客户推介频率最高的版本是 8-Hi HBM4 的 192GB 配置;另据 The Information 报道,送测样品的显存容量在 192GB 至 256GB 之间。
与现款配备高达 288GB HBM4 的 Rubin 相比,192GB 规格缩减了约 33%;若对比英伟达早期定下的约 1TB 目标,差距更为显著。英伟达目前尚未对此类变动作出公开回应。
全球 HBM 供应仅由 SK 海力士、三星和美光三家把持。面对 AI 加速器带来的庞大需求,三家厂商在 2026 年全力将晶圆产能向 HBM 倾斜。TrendForce 预计 DRAM 供应紧张态势将持续至 2027 年,短期内难以快速缓解。
产能吃紧直接体现在现货价格上。截至 9 月初,单颗 36GB HBM3E 模块现货交易价已飙升至约 2100 美元,是长期供应协议常见价(300 至 400 美元)的 4 到 5 倍。SemiAnalysis 强调,内存已在不知不觉中占到 AI 系统整体总拥有成本的约 40%,而英伟达降配将直接削减超过 50% 的 HBM 采购成本。
这一供应链压力同样波及其他硬件厂商。路透社 9 月 10 日报道称,由于 HBM 采购难度增加,包括华为和寒武纪在内的中国 AI 芯片企业已将加速卡售价上调 20% 至 50%。AI 云服务商 Nebius Group 宣布自 10 月 1 日起将按需 GPU 费率提高 17% 至 21%,其首席财务官表示新增算力一经上线便被抢购一空。
单卡显存变小,对云服务商和 AI 开发者带来直接冲击。当大语言模型无法塞入单颗芯片的显存池时,必须跨卡切分,从而增加了网络互联开销,推高了模型推理与服务的实际运行成本。显存精简的 Rubin Ultra 将迫使部分工作负载依赖规模更大的多 GPU 集群,这可能让当前一代硬件的淘汰替换周期顺延至 2028 年。
这一连锁反应同样波及消费级硬件。供应链消息显示,由于晶圆厂和存储供应商优先满足利润率更高的数据中心订单,英伟达下一代 RTX 60 系列和 AMD 基于 RDNA 5 的 Radeon 显卡发布节奏已被推迟至 2028 年前后。在 HBM 供应实质性改善前,产能争夺将完全倒向出价更高的产品,而数据中心 AI 加速卡在这场博弈中稳操胜券。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断