ITBear旗下自媒体矩阵:

WAIC上“低调”的昇腾机柜,如何在750套商用中书写算力新篇

   时间:2026-07-20 16:28:37 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

在今年的世界人工智能大会上,十件展品被评选为“镇馆之宝”,其中九件以直观的交互体验吸引观众驻足——会跳舞的机器人、能对话的数字人、自动编写代码的智能体,这些展品凭借生动的展示形式成为焦点。然而,位于H2馆A101展区的一排机柜却显得格外低调,没有炫目的交互界面,也少有人排队合影,但正是这组由1024张NPU卡组成的昇腾Atlas 950 SuperPoD,成为AI算力领域最具突破性的存在。

随着AI进入智能体时代,传统算力架构的局限性日益凸显。过去用户与AI单线程交互时,单台服务器即可满足需求;如今智能体需要同时处理航班查询、价格比对、规则解析、信息录入等十余项并行任务,对计算效率提出全新挑战。当计算节点增加时,多机间的通信延迟会呈指数级上升,导致大量算力消耗在数据搬运而非模型运算上,形成所谓的“通信墙”。与此同时,大模型参数规模突破万亿级,单台服务器内存无法承载完整模型,跨机调用数据时显存利用率大幅下降,又形成了“显存墙”。这两大瓶颈严重制约了AI系统的实际性能。

昇腾Atlas 950 SuperPoD通过创新架构突破了这些限制。该系统采用灵衢高速互联协议,将1024张加速卡整合为统一的计算单元,实现256TB内存空间的统一编址。这种设计使得万亿参数的MoE架构模型能够像在单卡上一样流畅运行,跨机柜数据搬运的开销被架构本身消化,同时解决了通信延迟与显存割裂的双重难题。作为目前业界规模最大的超节点集群,其单柜支持64卡扩展,最大可扩展至1024卡,重新定义了AI算力的部署方式。

这项技术并非首次亮相,其商业化进程早已领先行业。上一代384卡超节点系统已累计交付750套,在互联网、金融、医疗、交通等20余个行业实现规模化部署。这种市场认可度源于三个核心优势:经过长期验证的系统稳定性、符合行业需求的成本控制、以及可量化的投资回报。特别是在金融与科研领域,用户对技术故障的容忍度近乎为零,这750套系统的稳定运行,构成了最具说服力的技术认证。

国泰君安证券的实践具有典型意义。作为国内证券行业首个采用液冷技术的数据中心,其核心AI负载全部运行在昇腾超节点上。与互联网企业追求极致响应速度不同,金融行业更看重系统的零故障表现——交易系统每宕机一秒都会造成直接经济损失,风控模型延迟一分钟就意味着风险敞口扩大。该机构选择算力底座的标准,不是参数跑分,而是长期运行的稳定性记录、同行应用案例数量,以及完善的故障兜底机制。这种严苛需求倒逼技术提供商必须拿出经过实战检验的解决方案。

在科研领域,智源研究院的Brainμ神经科学大模型项目提供了另一个维度的验证。该模型基于7万余晚睡眠脑电数据,进行跨个体、跨模态分析,需要连续10个月稳定运行。研究团队对计算平台的要求不是瞬时峰值性能,而是面对不同实验条件时始终可靠的分析结果。最终,基于昇腾超节点的系统支撑了超过3000晚的人工双盲验证,其分析结果与神经科学博士的判断高度一致,相关成果发表于《科学》杂志,推翻了传统认知中“睡眠是被动恢复过程”的假设。

技术生态的完善为规模化应用奠定了基础。昇腾的CANN软件平台已全面开源,包含67个社区项目、1244万行代码,月活跃开发者超过3500人。该平台兼容Triton、PyTorch等主流框架,支持600多个开源算子,开发者可以无缝迁移现有模型,无需改变开发习惯。这种开放性加速了技术普及,使得不同领域的创新应用能够快速落地。

行业标准的确立则标志着产业成熟度的提升。全球计算联盟联合鹏城实验室发布的《超节点定义与实践白皮书》,首次系统定义了超节点的技术边界与架构特征。从追赶国际标准到主导标准制定,这种角色转变反映了中国在AI基础设施领域的实力积累。当750套系统在真实业务场景中持续运转,当开源代码每天被下载6万次,当产业标准开始引导全球技术走向,AI算力竞争的重心正从芯片性能转向系统效率。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version