DC娱乐网

英伟达Vera Rubin量产落地:能效 10 倍跃升,重塑AI推理基础设施

7 月 21 日,英伟达正式宣布 Vera Rubin NVL72 平台进入全面量产爬坡阶段,标志着面向智能体(Agen

7 月 21 日,英伟达正式宣布 Vera Rubin NVL72 平台进入全面量产爬坡阶段,标志着面向智能体(Agentic)AI 时代的新一代机架级超级计算机,从技术验证迈入规模化商用周期。目前,Google Cloud、Microsoft Azure、Oracle Cloud、CoreWeave 等全球头部云厂商与算力服务商已率先完成部署,全球 AI 算力基础设施升级加速落地。

Vera Rubin NVL72 的核心突破在于能效的量级级提升。据 CoreWeave 基于 DeepSeek-R1 模型的首次公开实测数据,该平台每兆瓦 Token 吞吐量较上代 Grace Blackwell NVL72 提升 10 倍,AI 推理成本同步降至原先的十分之一。整机柜集成 72 颗 Rubin GPU 与 36 颗 Vera CPU,搭载 20.7TB HBM4 显存,配合第六代 NVLink 高速互联技术,单机架带宽达 260TB/s,彻底解决大规模 AI 集群的通信瓶颈NVIDI...。

作为英伟达首款为智能体 AI 深度定制的平台,Vera Rubin 从芯片、网络到系统实现全栈协同设计。Rubin GPU 采用第三代 Transformer 引擎,支持 NVFP4 精度,算力达 50 PFLOPS;Vera CPU 搭载 88 颗定制 Olympus 核心,专为 AI 推理优化,核心间带宽提升 3 倍、内存延迟降低 40%财联社。网络层面,NVLink 6 实现 GPU 间 3.6TB/s 带宽,搭配 Spectrum-X 以太网,数据包处理速率提升 10 倍,延迟降低 3 倍,完美适配大模型长序列推理需求。

规模化量产能力是 Vera Rubin 快速普及的关键支撑。英伟达构建了覆盖全球 30 个国家、350 + 制造基地、300 + 合作伙伴的供应链体系,依托 MGX 生态实现模块化快速部署NVIDIA。相比上代产品,Vera Rubin NVL72 采用无电缆托盘设计,支持液冷散热,在提升能效的同时降低部署与运维复杂度,可无缝融入现有数据中心架构NVIDI...。

当前,AI 行业正从大模型训练转向高并发、低成本的推理应用,智能体技术的兴起进一步推高对高效算力的需求。Vera Rubin NVL72 的量产落地,恰好契合行业转型核心诉求 —— 以 10 倍能效提升、更低的单位 Token 成本,支撑万亿参数模型与长上下文任务的规模化部署NVIDI...。从云厂商到企业级用户,均可在相同功耗预算下承载更多推理流量,或用更少电力运行同等负载,显著降低 AI 应用落地门槛。

从行业发展维度看,Vera Rubin 的全面量产不仅是英伟达产品迭代的重要里程碑,更将推动全球 AI 算力格局重构。此前,CoreWeave 测试显示,即便上代平台通过优化,三个月内能效仅能提升 4 倍,而 Vera Rubin 原生架构实现 10 倍跃升,技术代差显著。随着谷歌、微软等云巨头持续扩容,Vera Rubin 有望成为未来三年 AI 推理基础设施的主流选择,加速智能体 AI 在各行各业的渗透落地。

技术迭代的终极价值,在于降低创新门槛、释放应用潜能。Vera Rubin NVL72 以全栈创新突破能效瓶颈,以规模化量产保障算力供给,正为 AI 行业开启 “高效能、低成本、广覆盖” 的全新发展阶段。