在近期举办的一场国际人工智能大会上,国产算力设备成为全场焦点。多家科技企业纷纷展出最新研发的超节点产品,这些外观朴素的黑色机柜吸引了大量观众驻足拍照,甚至成为展会热门打卡点。
华为、阿里巴巴、百度等企业均展示了各自的核心产品。中科曙光推出了全国产十万卡AI超集群系统,阿里巴巴展示了搭载128颗芯片的磐久超节点服务器,中兴通讯则推出了基于OEX架构的新型超节点。华为首次线下展出1024卡昇腾950超节点真机,沐曦股份和壁仞科技也分别展示了曦景S600超节点和支持千卡扩展的分布式架构。
这种转变反映了行业趋势的深刻变化。过去AI领域的竞争主要聚焦于单颗芯片的性能指标,但随着大模型训练进入万卡时代,单纯依靠高性能芯片已无法满足需求。如何将数千张AI卡高效协同,通过优化网络架构和调度系统释放集群算力,成为新的竞争焦点。业内专家指出,AI产业正从芯片硬件竞争转向系统级能力比拼。
大会评选结果印证了这一趋势。中科曙光、阿里巴巴和中兴通讯的超节点产品获评"镇馆之宝",标志着国产AI算力竞争进入新阶段。天数智芯副总裁邹翾表示,随着大模型应用场景扩展,算力需求从训练延伸至推理和边缘计算,系统协同效率正成为决定产品竞争力的关键因素。
超节点的技术实现远非简单堆砌硬件。摩尔线程工作人员介绍,其产品通过液冷散热、三盲插设计和智能管理系统,确保万卡级部署的稳定性。天数智芯则采用144芯高速全互联方案,结合软硬件协同优化提供高质量算力。阿里云自研的ALink互连架构,可最大化GPU集群的协同计算效率。
产业链协同的重要性日益凸显。相比单芯片开发,超节点涉及芯片、网络、散热、软件等多个环节,需要跨企业合作。中兴通讯联合多家合作伙伴推出的Matrix超节点,正是开放生态的典型案例。曦智科技创始人沈亦晨强调,构建开放产业生态至关重要,需让各环节企业发挥专长,共同推动算力基础设施升级。
技术演进仍在持续。中科曙光工程师解释,超节点相当于高密度计算单元,而超集群则是通过高速网络连接数百个超节点形成的十万卡级系统。当前技术挑战已从节点内部转向节点间通信,跨节点数据传输效率正成为影响大规模训练的关键因素。随着集群规模扩大,如何优化节点间通信架构将成为行业下一阶段的重要课题。








