ITBear旗下自媒体矩阵:

智谱GLM-5.3-Flash“牛来”开源,国产芯片集群高效支撑前沿模型推理

   时间:2026-08-27 10:48:15 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

智谱近日宣布,其GLM-5系列的首个原生多模态模型——GLM-5.3-Flash (320B-A18B)正式上线并开源。这一新模型在架构设计上进行了重大创新,旨在以极低的成本实现高性能,为人工智能领域带来了新的突破。

在正式发布前,智谱以匿名模型Ox-Alpha(中文社区昵称“牛来”)在OpenCode和OpenRouter平台上进行了大规模测试。测试结果显示,Ox-Alpha迅速成为当周最受欢迎的模型,在两个平台上均创下了调用量新高。尤为引人注目的是,这些请求流量全部由国产芯片提供算力支持,展现了国产芯片在大规模场景下的强大实力。

GLM-5.3-Flash在基准测试和实际应用中均表现出色,全面超越了参数量高出一倍的GLM-5.2模型。然而,其定价却仅为GLM-5.2的十分之一,这得益于其全新的模型架构。该架构专为降低成本而设计,总参数量与GLM-4.5相当,但激活参数量和层数几乎减半,从而显著降低了计算资源的需求。结合最新的30T Token多模态预训练语料,GLM-5.3-Flash能够以更少的资源实现更强的性能。

智谱方面透露,过去一周内,他们首次尝试使用大国产芯片集群为大规模流量提供服务。这些芯片通过自研的高带宽互联网络连接,实现了高效的协同工作。与同一硬件上的初始基线相比,端到端服务性能提升了三倍,硬件效率和单Token成本已达到与主流英伟达GPU相当的水平。这一成果证明,国产芯片完全有能力在大规模场景下高效、经济地支撑前沿模型的推理需求,为人工智能的发展提供了新的可能性。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version