在河北廊坊举办的2026中国算力大会上,一项突破性技术成果引发行业高度关注。由移动云公司牵头,联合中国电子科技南湖研究院、北京灵汐科技、上海天数智芯及清华、北大等顶尖科研机构,共同研发的国产GPU与类脑芯片异构混合推理系统正式亮相。该系统通过芯片级协同创新,为人工智能算力领域开辟了全新路径。
实测数据显示,基于Deepseek V4模型的测试表明,新系统在性价比指标上较传统国产GPU集群提升超100%,业务运营成本降幅达40%以上。这一突破得益于其独特的"分域部署"架构设计——将大模型拆解为注意力计算(Attention)与前馈网络(FFN)两大核心模块,分别由国产GPU与类脑芯片承担专项计算任务。其中,国产GPU负责处理需要大规模并行计算的注意力机制,而类脑芯片则凭借存算一体架构和片上大容量SRAM,高效执行对延迟敏感的FFN模块运算。
技术团队通过自主研发的模型编译器、高速互联协议及统一推理引擎,实现了异构芯片间的无缝协作。这套系统不仅能够自动完成任务拆解、算力调度和结果聚合,更突破了传统单GPU推理的性能瓶颈。据现场演示,在处理包含数万亿参数的超大模型时,系统推理延迟降低至毫秒级,能效比显著优于同类方案。
该成果已展现出广泛的应用潜力。在智能制造领域,其低延迟特性可支撑实时质量检测系统;金融行业则利用其全栈国产化特性构建风险控制模型;安防领域通过异构算力融合,实现了多模态数据的同步分析。研发团队特别强调,系统在多智能体协同、AI代码生成等高实时性场景中表现突出,特别适合对数据安全要求严苛的通信、政务等关键领域。
这项创新标志着我国在人工智能算力基础设施领域取得重要进展。通过将通用计算与神经形态计算深度融合,不仅解决了国产芯片生态碎片化问题,更为构建自主可控的AI算力底座提供了可行方案。随着系统在更多行业的落地应用,有望推动我国人工智能产业向更高水平迈进。









