在华为全联接大会上,华为副董事长、轮值董事长汪涛宣布推出全球首款采用NPO技术的超节点——昇腾960超节点。这款超节点基于“灵衢+Hi-ONE”架构打造,采用正交架构与全液冷设计,通过灵衢技术实现内存统一编址,支持扩展至4096卡规模,提供8 EFLOPS FP8和16 EFLOPS FP4的算力水平,为超大规模AI基础设施建设提供了关键支撑。
汪涛强调,华为AI战略的核心聚焦于算力创新,通过“超节点+集群”的系统架构突破,构建差异化竞争力。随着大模型参数规模向十万亿级迈进,超节点已成为支撑超大规模AI训练的必然选择。华为的超节点设计理念强调组件间的平等连接协议,支持跨物理服务器的内存共享访问,并采用近铜远光的互连技术优化数据传输效率。
同期发布的Hi-ONE光引擎作为全球首个量产的NPO产品,总容量达7.2T,是唯一内置光源的NPO解决方案。昇腾960超节点通过集成5500个Hi-ONE光引擎,替代了传统方案中4.8万颗800G光模块的需求,不仅将功耗降低超550千瓦,更使系统无故障运行时间翻倍,系统可用度提升至99.8%。
在通用计算领域,华为将超节点架构引入鲲鹏系统,推出升级版鲲鹏超节点。该系统基于灵衢全光组网技术,最大支持4096节点互联,形成256TB统一内存池,显著提升了Agent沙箱的密度、启动速度及向量检索性能。华为还发布了基于灵衢UnifiedBus总线的L3.5层PB级KV缓存解决方案OceanStor M900集群,支持“一跳直连”技术优化数据访问效率。
在集群扩展能力方面,多个昇腾960超节点可通过灵衢网络或RoCE协议连接,采用二层CLOS四平面组网架构,最大支持51.2万卡集群规模。结合多轨道拓扑技术,该方案可进一步扩展至100万卡规模的昇腾超节点集群,满足未来超大规模AI训练的需求。
汪涛透露,华为正持续推进算力生态的开源开放战略。目前,CANN计算框架已实现全面开源并进入常态化社区运营,昇腾生态发展已跨越关键拐点,为全球开发者提供更开放的算力创新平台。











