在AI热潮中,英伟达已将其重点从游戏和专业GPU业务转向AI硬件设计,推动其市值接近5万亿美元。现在,该公司推出了其下一代AI平台:Vera Rubin“超级芯片”,专为高强度生成式AI工作负载而设计。
新的超级芯片近日在华盛顿的英伟达GPU技术大会(GTC)上由联合创始人兼首席执行官黄仁勋揭晓。Vera Rubin平台配备了一个“VeraCPU,拥有88个定制的Arm核心和176个线程,以及两个“Rubin”GPU,提供高达100 petaFLOPS的FP计算性能。
Vera Rubin是英伟达第三代LVLink 72机架级计算机,继GB200和GB300之后该液冷系统包含6万亿个晶体管,并配备了2 TB的低延迟SOCAMM2内存。

基础配置的计算性能大约是英伟达首款专为深度学习设计的平台DGX-1(基于Volta架构)的100倍,该平台提供了170万亿次每秒的半精度(FP16)峰值性能。
Vera Rubin将提供多种配置,包括NV144和NVL144 CPX。NVL144配备了两块晶圆大小的GPU,提供高达3.6 Exaflops 的 FP4 推理能力和 1.2 Exaflops 的 FP8 训练能力。NVL144 CPX的性能评级为 8 Exaflops——比英伟达当前GB300 NVL72系统强大7.5倍。
对于需要更大处理能力的数据中心,Nvidia将提供其定制的Rubin Ultra NVL576系统。该系统配置了四个大小的GPU和高达365 TB的高速内存,NVL576提供了高达15 exaflops的FP4推理和5 exafops的FP8训练性能——比GB300提高了8倍。

每个Rubin GPU包含两个计算芯片和八个HBM4内存堆栈。该板卡还包括五个NVLink后背板连接器——两个,底部三个。顶部连接器旨在将GPU连接到NVLink开关,而底部连接器则处理电源、PCIe和CXL连接。 黄仁预计Rubin GPU将在2026年下半年进入大规模生产。NVL144系统计划在当年晚些时候或2027年初推出,而NV576系统预计将在2027年下半年首次亮相。