智谱AI近日推出的GLM‑5.3‑Flash开源大模型,在国产算力领域引发广泛关注。作为GLM‑5系列中首款原生多模态架构模型,该成果上线次日便获得两家头部企业的适配支持,标志着国产人工智能生态建设迈出关键一步。
壁仞科技通过自主研发的SGLang推理框架与BIRENSUPA软件栈,在壁砺166M芯片上完成全流程验证。该方案不仅实现模型高效推理,更形成可复制的部署路径,为开发者提供标准化技术参考。据技术团队透露,此次适配重点优化了多模态数据流处理能力,使硬件资源利用率提升30%以上。
摩尔线程则依托MTT S5000智算卡与MUSA软件栈的协同优势,构建起极速适配体系。通过动态算力分配算法与内存管理优化,该方案在保持模型精度的同时,将推理延迟压缩至毫秒级。测试数据显示,在相同硬件配置下,其处理效率较国际主流方案提升22%,特别在视频理解等复杂场景表现突出。
此次双平台落地具有双重示范效应:既验证国产芯片对前沿AI架构的兼容能力,又为中小企业提供低成本部署方案。行业分析师指出,当硬件厂商与模型开发者形成技术共振,将加速构建自主可控的AI基础设施,这对打破技术垄断、推动产业升级具有战略意义。目前,相关部署文档已向社区开放,预计将催生更多垂直领域应用创新。









