ITBear旗下自媒体矩阵:

CoreWeave率先启用多机架英伟达Vera Rubin NVL72集群 推动AI云算力升级

   时间:2026-09-16 22:51:35 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

近日,CoreWeave(CRWV.US)宣布在其云服务平台上正式启用一套由多机架组成的英伟达(NVDA.US)Vera Rubin NVL72集群。该集群将数百颗英伟达Rubin图形处理器(GPU)互联为一个统一系统,专为智能体AI(agentic AI)工作负载提供算力支持。据介绍,这种多机架架构能够跨数百颗GPU调度训练与推理任务,为大规模模型训练、高强度推理及强化学习场景提供强大的计算支撑。

每个Vera Rubin NVL72机架整合了72颗Rubin GPU与36颗Vera CPU,并搭载英伟达自主研发的网络与数据处理技术。多个机架通过英伟达Spectrum-X以太网实现互联,形成横向扩展集群协同运行。CoreWeave强调,其基础设施可自动化完成机架部署、固件升级、系统验证以及能源供应与散热管理,并在投入生产前进行全机架级别的严格测试,确保系统稳定性与效率。

CoreWeave执行副总裁兼产品与工程负责人Chen Goldberg表示,该公司是业内首家完成Vera Rubin NVL72验证并投入实际运行的AI云服务提供商。他指出:“通过多机架Vera Rubin架构,我们将数百颗GPU连接为单一横向扩展集群,为开发智能体AI的客户提供更庞大的计算规模与更高效的迭代能力。”这一技术突破有望加速AI模型的训练与优化进程。

在扩展计算能力的同时,CoreWeave还为其AI对象存储平台新增了跨区域写入加速功能。该功能允许AI工作负载在运行区域直接写入数据,系统后台自动将数据复制至其他区域,从而减少多区域训练任务中的暂停时间。这一优化尤其适用于需要跨地域协同训练的客户,可显著提升数据同步效率。

CoreWeave推出了Archive存储层,为长期数据保留需求提供低成本解决方案。该存储层不收取数据取回费用、提前删除费用或读取费用,并配备本地对象传输加速器(LOTA)。LOTA可将数据缓存至更靠近AI工作负载的位置,使数据读取延迟较传统存储集群降低8倍,进一步优化了AI任务的数据访问性能。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version