6月1日,在台北国际电脑展(COMPUTEX 2026)主题演讲中,英伟达 CEO 黄仁勋正式宣布 Vera Rubin 平台全面投产。这款被英伟达定位为"迄今为止规模最大的 POD 级平台"的下一代 AI 超级芯片,标志着 AI 算力基础设施从"千卡级"向"万卡级"跃迁的关键节点,也预示着智能体(Agentic AI)时代算力竞赛进入白热化阶段。

一、核心性能:十倍降本,三倍提速
Vera Rubin 最引人注目的性能承诺是单Token推理成本降至 Blackwell 的十分之一,同时大规模智能体吞吐量提升10 倍。这一"降本增效"的组合拳,直击当前 AI 部署的最大痛点——推理成本。
旗舰配置 Vera Rubin NVL72 的硬核参数包括:
72 颗 Rubin GPU + 36 颗 Vera CPU,通过 NVLink 6 实现全对全无阻塞互联
总显存 20.7 TB HBM4,带宽达 28.8 TB/s
NVFP4 推理性能 3,600 PFLOPS,FP8 训练性能 2,520 PFLOPS
NVLink 总吞吐量 260 TB/s,较前代翻倍
每瓦推理吞吐量较 Blackwell 提升 10 倍
Rubin GPU 单颗即可提供 50 PFLOPS 的 NVFP4 推理算力,是 Blackwell 的 5 倍;配备 288 GB HBM4 显存,带宽 13 TB/s,较 Blackwell 的 HBM3E 提升 60% 以上。Vera CPU 则搭载 88 个定制 Olympus 核心(ARM v9.2-A 架构),支持 176 线程与空间多线程技术,内存带宽 1.2 TB/s,较前代 Grace CPU 性能翻倍。
二、POD 级平台:五个机架组成的 AI 超级计算机
Vera Rubin 并非单一芯片或服务器,而是英伟达迄今为止规模最大的 POD 级平台——由 五个专用机架组成一个庞大的 AI 超级计算机,专为智能体工作负载而设计。
机架组件 | 功能定位 |
Vera Rubin NVL72 | GPU 计算核心,搭载 72 颗 Rubin GPU |
Vera CPU | 智能体编排与数据预处理,搭载 88 核 Olympus CPU |
Groq 3 LPX | 专用推理加速,优化智能体响应速度 |
Vera BlueField-4 STX | 存储与数据卸载,支持上下文记忆共享 |
Spectrum-6 SPX | 以太网网络互联,采用 CPO 硅光子技术 |

这五个机架通过英伟达自研的高速互联技术深度耦合,整合为一个完全集成的系统。其中,Vera CPU 与 Rubin GPU 之间通过 第二代 NVLink-C2C 实现高达 1.8 TB/s 的一致性带宽,CPU 可直接访问 GPU 显存,消除传统 PCIe 的数据搬运瓶颈。BlueField-4 STX 存储机架新增的"上下文记忆存储"技术,可让多个 GPU 高速共享 KV Cache,将推理速度与能效提升 5 倍。
这种"五机架一体"的 POD 级设计,使得 Vera Rubin 不再是零散组件的简单堆叠,而是一个针对智能体并发工作负载深度优化的完整 AI 工厂单元——从计算、存储到网络,全栈协同,即插即用。
三、散热革命:100% 液冷,无风扇设计
为支撑 2.3kW 超高功耗芯片的稳定运行,Vera Rubin 采用了第三代完全无缆化设计与100% 全液冷覆盖方案。旗舰 NVL72 机架实现无缆化、无风扇模块化设计,构建"精准温控+高效换热"的整机散热生态。
摩根士丹利分析师指出,Rubin 平台的散热升级将带动液冷核心组件需求爆发。下一代 Vera Rubin NVL144 平台单个机柜的冷却组件总价值预计达 5.57 万美元,较上一代 GB300 平台增长17%。具备精密加工能力和全栈解决方案能力的液冷供应商将迎来显著市场机遇。
四、量产节奏:供应链规模翻倍,秋季开始发货
黄仁勋在 COMPUTEX 上强调,Vera Rubin 的供应链规模是 Grace Blackwell 的两倍。凭借成熟的开源 MGX 设计,英伟达供应链生态系统的数百家合作伙伴正在 30 多个国家的 350 多家工厂中加速生产。
量产时间线清晰:
2026 年 6 月:全面投产,开始试生产
2026 年 7 月:开始向北美 CSP(微软、谷歌、亚马逊、Meta、Oracle)供货
2026 年秋季:首批产品正式发货
2026 年 Q4:产能爬坡,大规模出货
台积电已于今年早些时候采用 3nm 工艺量产 Vera Rubin 芯片。鸿海、广达、纬创及 Supermicro 等主要 AI 服务器厂商已接收实际芯片样品为量产做准备。其中鸿海已提前启动 Vera Rubin NVL144 MGX 服务器开发工作。
值得注意的是,英伟达此次对 Vera Rubin 采取更严格的供应链管控策略:系统先由纬创、广达及鸿海组装至 L10 层级,再由英伟达统一完成机架整合与交付,以确保每个机架性能一致。这种"整机柜交付"模式,标志着 AI 基础设施从"卖芯片"向"卖 AI 工厂"的商业模式转变。
五、客户生态:云巨头全线押注,AI 实验室抢先卡位
Vera Rubin 的客户阵容堪称"全明星":
云服务商:微软(Fairwater AI 超级工厂将部署数十万颗)、AWS、谷歌云、Oracle Cloud
AI 实验室:OpenAI、Anthropic(已接收首批样品)
商业航天:SpaceX AI(马斯克亲自签收,用于强化学习与智能体仿真)
系统制造商:戴尔、HPE、联想、超微
微软已率先上线 Vera Rubin NVL72 工程机机柜,成为首家大规模部署的云服务商。甲骨文承诺 2026 年起部署数十万颗 Vera CPU。这种"云厂+AI 厂+系统厂"的全覆盖格局,确保了 Vera Rubin 从发布之初就具备成熟的生态落地能力。

六、战略意义:从"算力供应商"到"AI 工厂架构师"
Vera Rubin 的全面投产,不仅是英伟达产品线的迭代,更是其战略定位的升级:
商业模式跃迁:从销售单颗 GPU/CPU,转向销售"机架级 AI 工厂"。Vera Rubin NVL72 作为一个完整的计算单元交付,客户购买的是"即插即用"的 AI 生产力,而非零散组件。
技术路线锁定:通过 NVLink-C2C 实现 CPU-GPU 统一内存架构,通过 CPO 硅光子技术重构网络层,英伟达正在构建一个从芯片到机柜、从计算到网络的全栈闭环。竞争对手即便在单点突破,也难以撼动其系统级优势。
智能体时代占位:Vera Rubin 专为 Agentic AI 设计,其 CPU 负责模型调度、内存管理和工具调用编排,GPU 负责并行计算,DPU 负责数据卸载——这种"分工明确、协同高效"的架构,正是未来 AI 智能体大规模并发运行所需的基础设施。
七、未来路线图:Rubin Ultra 与 Feynman 已在路上
英伟达的"一年一代"节奏仍在加速:
2026 年下半年:Vera Rubin NVL144 平台,性能较 GB300 NVL72 提升 3.3 倍
2027 年下半年:Rubin Ultra NVL576 平台,性能提升达 14 倍
2028 年:下一代架构 Feynman(以物理学家理查德·费曼命名)亮相
当黄仁勋在 COMPUTEX 2026 的舞台上宣布 Vera Rubin 全面投产时,他传递的核心信息不仅是"我们造出了更快的芯片",而是"我们重新定义了 AI 工厂的标准形态"。在智能体时代,算力竞争已从"单卡算力"转向"系统效率",从"训练速度"转向"推理成本"。Vera Rubin 以"六芯协同、十倍降本、全栈液冷"的组合拳,正在将 AI 部署的经济可行性推向新高度。随着秋季发货的临近,全球 AI 产业的基础设施格局,或将迎来又一次深刻重构。