阿里云近日宣布,其自主研发的灵骏真武M890超节点实例已成功完成对Qwen3.8大模型的适配,并正式在阿里云百炼平台上线提供推理服务。这一突破标志着国内首次实现超2万亿参数规模大模型在超节点架构上的稳定运行,为人工智能大模型训练与推理提供了新的算力支撑方案。
Qwen3.8作为当前参数规模最大的开源大模型之一,其2.4万亿参数的运算需求对硬件架构提出极高挑战。为满足模型运行要求,阿里云采用分布式计算策略,将参数拆分至数十张通过高速互联技术连接的GPU卡中。真武M890作为平头哥半导体推出的新一代训推一体AI芯片,通过原生支持FP32至FP4多精度计算,为模型运算提供了灵活的算力支持。该芯片搭载的ICN Switch 1.0互联技术,实现了64张芯片间800GB/s的带宽传输,构建起总显存达9TB的超大算力集群。
技术团队针对混合专家模型(MoE)的并行计算特性,对超节点架构进行了深度优化。通过改进芯片间通信协议与内存管理机制,单实例即可支持大规模MoE模型的专家并行推理需求。在针对智能体(Agentic)推理场景的实测中,经过全链路优化的系统架构使推理性能较传统方案提升最高达1.5倍,显著降低了大规模模型部署的时延与成本。
此次技术突破不仅验证了国产AI芯片在超大规模模型训练领域的可行性,更为云计算平台提供了新的算力解决方案。阿里云百炼平台通过整合硬件创新与软件优化,为开发者提供了开箱即用的大模型推理服务,有望推动AI技术在更多垂直领域的落地应用。









