ITBear旗下自媒体矩阵:

智谱GLM-5.3 Flash轻量旗舰模型登场,10万国产芯片集群助力推理服务

   时间:2026-08-27 00:41:16 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

国内轻量级AI旗舰模型领域正迎来新一轮激烈角逐。智谱科技近日推出GLM-5.3 Flash模型,该模型直接对标DeepSeek V4 Flash,在参数规模与功能定位上形成正面竞争。据技术文档披露,新模型采用300B参数架构,约为前代GLM-5.3的40%,与DeepSeek同类产品参数量相当,但通过全新架构设计实现了原生多模态支持,可同时处理图像与视频输入,这标志着智谱自聚焦代码生成领域后首次重返多模态赛道。

支撑这款模型运行的硬件集群颇具看点。知情人士透露,智谱调动超过十万张国产芯片构建推理服务网络,算力供应方可能涉及华为、摩尔线程及海光信息等企业。尽管官方未确认具体合作方,但技术白皮书强调其硬件效率已达到国际主流GPU水平,单位token处理成本与英伟达产品相当。这种全栈国产化适配策略,使GLM-5.3 Flash成为目前少数完全基于国产算力的旗舰级模型。

性能评测数据显示,该模型在内部测试中取得57分的Artificial Analysis Intelligence评分,不仅超越前代GLM-5.2,更与Claude Opus 4.8持平,领先DeepSeek V4 Pro正式版4个百分点。价格策略方面,GLM-5.3 Flash展现出显著优势:输入成本每百万token 0.8元,输出2.8元,缓存命中价0.23元,仅为GLM-5.3的十分之一。即便与调价后的DeepSeek V4 Flash相比,在常规使用场景下仍保持20%-30%的价格优势。为快速抢占市场,智谱宣布上线首两周实行半价促销。

市场验证环节已现端倪。在正式发布前,该模型以Ox Alpha的代号在OpenRouter等第三方平台进行压力测试,五天内积累超50TB流量,创下平台流量增长纪录。这种匿名测试策略并非首次使用,今年春节前夕,同样以Pony Alpha名义测试的GLM-5模型就曾引发关注。频繁的匿名测试反映出厂商对市场反馈的高度重视,也为模型优化提供了宝贵数据。

行业价格体系正在经历重构。今年6月以来,国内AI公司密集发布新一代产品:智谱GLM-5.2、Kimi K3、DeepSeek V4 Pro等模型相继入场。其中Kimi K3将输出价格推高至100元/百万token,较前代暴涨300%,智谱上半年跟进提价后输出价达28元。但市场很快给出回应——DeepSeek V4 Flash提价后,在OpenCode平台的调用量骤降50%,流失用户转向更具性价比的国产方案。这种价格敏感度在轻量级模型领域尤为明显,用户既要求接近旗舰的性能,又对成本变动高度警惕。

国际对比显示,中国模型厂商正通过价格杠杆重塑竞争格局。以Claude Opus 4.8为例,其海外输出价格达25美元/百万token,而GLM-5.3 Flash的同等服务仅需0.5美元,价差超过50倍。这种差异源于国内特殊的竞争环境:模型选择丰富、性能差距缩小,加之开源部署和云服务商免费额度冲击,使得价格成为主要竞争手段。厂商不得不将旗舰级能力下放至低价区间,通过规模效应维持利润。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version