英伟达近日宣布,其备受瞩目的Vera Rubin架构正加速迈向万亿级规模部署阶段。这一消息标志着英伟达在高性能计算领域再次取得重大突破,为全球客户提供更强大的计算能力支持。
为满足全球客户日益增长的计算需求,英伟达已建立起有史以来规模最大、最成熟的机架级供应链。该供应链覆盖30个国家,拥有超过350个工厂,确保Vera Rubin架构的量产和交付能力。目前,Vera Rubin NVL72已在CoreWeave、Google Cloud、Microsoft Azure和Oracle Cloud Infrastructure等合作伙伴的数据中心内部运行,为各类计算密集型应用提供强大支持。
CoreWeave公司率先完成了业界首个NVIDIA Vera Rubin NVL72的上电和验证工作。该公司于6月初成功搭建了端到端的机架级系统,涵盖电源、冷却、网络和计算等核心组件,并验证了其稳定运行能力。这一成果为Vera Rubin架构的广泛应用奠定了坚实基础。
在性能测试方面,英伟达基于当前推动智能体AI(Agentic AI)快速发展的推理模型DeepSeek R1,对Vera Rubin NVL72和NVIDIA Blackwell NVL72进行了对比评估。测试重点考察了每兆瓦吞吐量(token throughput per megawatt)与交互性(TPS/user,反映用户或智能体在模型处理任务时的响应速度)之间的关系。
测试结果显示,在相同的DeepSeek R1工作负载下,Vera Rubin NVL72在匹配的交互性目标下,每兆瓦Tokens吞吐量较NVIDIA GB200 NVL72提升高达10倍。这一显著优势使Vera Rubin架构在处理大规模AI推理任务时具备更高的能效比和更快的响应速度,为AI应用的广泛部署提供了有力支撑。











