ITBear旗下自媒体矩阵:

国产超算“灵晟”纯CPU架构显威力:16节点媲美80张GPU集群

   时间:2026-08-08 01:28:22 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

全球超算领域迎来重大突破,国产超算“灵晟”在纯CPU架构下成功实现MoE模型分布式推理部署,标志着我国在AI计算领域迈出关键一步。该系统仅需16个计算节点即可流畅运行DeepSeek-V3/R1-671B满血模型,在并发数达2048时,输出吞吐量与配备80张主流GPU的集群相当,彻底改变了“大模型必须依赖GPU”的行业认知。

“灵晟”的核心创新在于其独特的纯CPU架构设计。与传统依赖GPU或专用加速卡的方案不同,该系统采用自研的LX2处理器,通过片上集成矩阵加速单元,实现了科学计算与AI推理任务的协同处理。这种融合设计消除了CPU与加速卡间的数据传输瓶颈,使单颗芯片即可同时承担两类计算负载,显著提升了资源利用率。

内存带宽曾被视为大模型推理的主要障碍,为突破这一限制,LX2处理器首次搭载国产高带宽内存(HBM),总带宽达4TB/s,较传统CPU内存提升10倍。配合自主研发的“灵启”高速网络架构,该系统支持微秒级通信时延与10万节点规模组网,构建起计算、存储、通信三位一体的高效体系。实测数据显示,优化后的MoE模型推理时延从1440微秒压缩至980微秒,结合DeepSeek多token预测技术,输出速率得到进一步提升。

这一技术突破使“灵晟”的应用场景从传统科学计算扩展至AI大模型生产服务领域。系统团队透露,通过软硬件协同优化,纯CPU架构在能效比和成本可控性方面展现出独特优势,为国产AI基础设施提供了新选择。值得注意的是,该超算已于今年6月在德国汉堡ISC2026大会上登顶全球超算TOP500榜单,时隔九年重返世界第一宝座,彰显了我国在高性能计算领域的综合实力。

行业专家指出,“灵晟”的成功验证了纯CPU架构处理大规模AI任务的可行性,其片上融合设计与国产HBM技术的突破,为全球超算发展提供了全新范式。随着国产AI生态的完善,这类创新架构有望在智能计算领域发挥更大作用,推动人工智能与科学计算的深度融合。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version