智谱发布GLM-5.3:编程安全双突破

作者:Yu 来源:原创 2026-08-14

  比特网8月14日消息,智谱日前发布新一代模型GLM-5.3。与GLM-5.2相比,基座模型没变,所有智能提升全部来自后训练。

  智谱官方的表述是,团队基于同一基座,通过极致的后训练Scaling顶开智能上界:数十倍于前代的长程任务环境、更丰富多样的环境类型、超长的后训练时间,以及基于IndexShare、SAO和新一代Slime框架持续推进的强化学习。换言之,智谱没有换发动机,而是把同一台发动机的转速压榨到了新的高度。

  效果是可量化的。在衡量真实终端环境复杂任务完成能力的Terminal-Bench 3.0上,GLM-5.3得分从4.6跃升至28.3;在聚焦长程软件工程的 DeepSWE v1.1上,从46.2提升至66.9;在Agents' Last Exam上从23.8提升至28.5。编程能力较前代提升约50%,在公开基准中拿下开源第一,并逼近 Claude Fable 5。

  更值得注意的是,GLM-5.3涌现出了网络安全能力:在白盒代码审查、漏洞发现等安全任务上表现持平Mythos 5,在CyberGym测试中得分84.5%。官方明确将其定位为"保留防御价值、限制潜在攻击能力"的模型——能力越强,安全加固的优先级越高。

  配套动作同步落地:官方编程工具ZCode、效率工具AutoClaw即日上线,GLM Coding Plan开放订阅,TraeWork、扣子、OpenCode等编码平台 Day 0接入。完整模型权重将在两周内开源,此前需完成必要的安全评估与模型加固。

  GLM-5.3的意义在于它宣告开源大模型的竞争主轴正式切换,从谁造得出更大的基座,变成谁更会把同一个基座炼得更好。一次预训练投入可以被多代模型持续摊薄,这对所有深陷算力成本焦虑的厂商都是重要参照:消化训练成本的路径,不只有涨价,还有让基座多服役几代。而当模型能力差距被后训练工程逐渐抹平,工具链、开发者生态与安全治理,就成了下一场竞赛的真正赛点。

发布
X
第三方账号登录
  • 微博认证登录
  • QQ账号登录
  • 微信账号登录

企业俱乐部