近日,一款名为GLM-5.3-Flash的模型在海外科技圈引发广泛关注。该模型在正式发布前,以匿名形式登陆OpenRouter、OpenCode两大国际知名平台进行测试,凭借卓越性能迅速登顶双平台榜单,并一举刷新历史最高纪录。据统计,测试期间其Token调用量突破62T,展现出强大的技术实力和市场潜力。
值得注意的是,支撑这一模型运行的所有线上流量均由10万张国产芯片提供算力支持。这一技术突破标志着国产算力芯片首次以集群形式大规模参与国际竞争,直接面向全球用户提供真实服务。从测试数据到实际部署,国产芯片全程承担了高强度计算任务,验证了其在复杂场景下的稳定性和可靠性。
此次集体"出海"不仅展现了国产芯片的技术成熟度,更打破了国际市场对国产算力设备的传统认知。通过在海外主流平台直接参与全球竞争,国产芯片实现了从技术验证到商业落地的关键跨越。62T的Token调用量背后,是国产算力在自然语言处理领域的一次重要实践,也为后续更多国产技术走向世界奠定了基础。










