随着 AI 智能体和万亿参数工作负载成为主流,NVIDIA 扩展 NVLink Fusion 平台,推出与未来 GPU 同源的定制高带宽内存 NVHBM。该技术将内存控制器集成到 HBM 基底芯片,相比标准 HBM4E 带宽提升 30%、功耗降低 15%,并释放 25% 的 XPU 计算芯片面积。亚马逊 Annapurna Labs 成为首个合作伙伴。

新一代人工智能对基础设施提出了更高要求。随着 AI 智能体和万亿参数工作负载走向主流,AI 基础设施的性能不仅取决于算力,更取决于计算、内存、存储、网络和软件能否作为一个统一系统协同设计。
为了帮助超大规模云厂商和 AI 创新者构建下一代半定制 AI 基础设施,NVIDIA 宣布扩展 NVIDIA NVLink Fusion 平台,并推出 NVIDIA NVHBM 定制高带宽内存技术。NVHBM 是新一代高带宽内存技术,可为 XPU 带来更高的内存性能和效率。领先内存合作伙伴将对其进行验证并提供,将这一先进内存能力扩展至 NVLink Fusion 客户。
传统 HBM 架构把内存控制器放置在 XPU 芯片上,占用了本可用于计算的宝贵硅片面积。NVHBM 采用 NVIDIA 未来 GPU 将使用的同源技术,将 NVIDIA 自研内存控制器集成到 HBM 基底芯片中。相比标准 HBM4E,这一设计带来最高 30% 的内存带宽提升、15% 的 HBM 功耗降低,并为 XPU 计算芯片释放最多 25% 的额外面积。
NVIDIA 正在建立标准化的 NVHBM 实现,并由多家内存供应商提供。这减少了跨供应商集成和资格认证所需的工程投入,让 NVLink Fusion 客户能够更快将定制 AI 芯片推向市场。
亚马逊的 Annapurna Labs 将成为首个围绕 NVHBM 开展合作的伙伴,这也是其与 NVIDIA 在 NVLink Fusion 更广泛合作的一部分。
亚马逊的 Annapurna Labs 将与 NVIDIA 合作开发 NVHBM 技术和 NVLink 纵向扩展架构,以提升 AI 工作负载的性能和效率。
这一合作建立在 AWS 此前已宣布的对 NVLink Fusion 的支持之上。Annapurna Labs 将从下一代 Trainium 芯片 Trainium4 开始支持 NVLink Fusion,让亚马逊自研芯片与 NVIDIA GPU 能够基于共同的机架级架构协同工作。
“NVHBM 代表了一种推进高带宽内存性能与效率的新架构方法,”亚马逊 Annapurna Labs 副总裁 Nafea Bshara 表示,“我们期待这项技术合作能够惠及未来的 AWS 基础设施设计。”
NVLink Fusion 允许合作伙伴将自研 XPU 和 CPU 接入 NVIDIA 的机架级平台。合作伙伴可以使用 NVIDIA NVLink chiplets、NVLink-C2C、NVLink 交换机和 NVIDIA MGX 系统及机架,以及由 CPU 合作伙伴、ASIC 设计公司、系统制造商和技术提供商组成的广泛生态。
NVLink Fusion 随每一代 NVIDIA 机架级系统架构一同提供,让超大规模云厂商和 AI 原生公司能够将工程资源聚焦于 XPU 创新,同时借助经过验证的技术栈实现纵向扩展、横向扩展网络、机架级系统和软件——为部署半定制 AI 基础设施提供更快、更低风险的路径。
了解更多 NVLink 和 NVLink Fusion。
原文链接:NVIDIA AI Blog
本文由前途科技编辑整理
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断