ITBear旗下自媒体矩阵:

智谱GLM-5.3正式登场:后训练Scaling赋能,开源模型编程与安全能力双飞跃

   时间:2026-08-15 03:31:58 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

智谱正式推出新一代开源模型GLM-5.3,在保持基座模型不变的前提下,通过后训练Scaling技术实现性能跃升。该模型在长程任务处理、环境多样性及训练时长方面取得数十倍突破,展现出更强的智能潜力。据内部测试显示,GLM-5.3在编程能力、网络安全防御等核心场景中表现突出,多项基准测试成绩刷新开源模型纪录。

在编程能力维度,GLM-5.3以显著优势领跑开源领域。内部体感评测显示其编程能力较前代提升50%,在Terminal Bench 3.0和Agents' Last Exam (CLI)等国际权威基准测试中均位居开源模型榜首。真实开发环境测试表明,该模型在复杂本地开发场景下的任务完成准确率达31.4%,超越Claude Opus 4.8最高档位表现,且输出token量仅为后者的40%,展现出更高的执行效率。

网络安全领域同样取得突破性进展。GLM-5.3在白盒代码审查和漏洞发现等安全任务中,性能表现与商业模型Mythos 5持平。测试数据显示,该模型在DeepSWE v1.1长程软件工程测试中得分提升至66.9,较前代增长45%;在覆盖44种职业的GDPval-AA v2专业场景测试中取得1,769分,证明其具备处理高价值知识工作的能力。

技术实现层面,智谱通过自主研发的IndexShare、SAO框架及新一代Slime强化学习系统,在相同基座模型上实现性能倍增。这种后训练优化方式不仅提升了模型上限,更验证了现有架构的巨大潜力。为确保技术安全可控,模型将在完成全面安全评估与加固后,于两周内开放完整权重下载。

生态建设方面,智谱同步推出ZCode编程工具和AutoClaw效率平台,并向GLM Coding Plan全体用户开放全量功能。TraeWork、CodeBuddy等十余个编码平台已启动抢先体验计划,API服务即将上线。值得关注的是,所有用户今日13:00起将自动重置使用额度,可在后台用量统计页面查看更新后的资源配额。

专业评测机构指出,GLM-5.3在真实场景中的综合表现已接近Claude Fable 5水平,尤其在编程体感方面超越多数国产模型。其创新的训练范式为开源社区提供了新思路,而严格的安全管控机制也平衡了技术开放与风险防控的需求。随着完整模型的即将开源,预计将引发新一轮AI开发工具链的革新。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version