发生了什么
8 月 14 日,智谱正式发布新一代旗舰模型 GLM-5.3。智谱方面介绍,与 GLM-5.2 相比,GLM-5.3 的基座模型并未更换,能力提升完全来自后训练阶段的大规模扩展:数十倍的长程任务环境、更丰富多样的环境类型,以及超长的后训练时间,最终拉高了模型的智能上界,并涌现出超出预期的能力。
关键变化
- 编程能力:官方自建体感评测中较 GLM-5.2 提升约 50%,在 Terminal-Bench 3.0 取得 28.3 分的开源模型最佳成绩,并在 Agents' Last Exam (CLI) 等公开基准中排名开源第一;
- 网络安全能力:在白盒代码审查与漏洞发现任务中表现持平 Mythos 5,据称在现实代码库中累计识别出 2436 个安全漏洞;
- 落地节奏:即日起上线智谱官方编程工具 ZCode、效率工具 AutoClaw,并面向 GLM Coding Plan 全量用户开放订阅,额度已重置;
- 开放计划:API 很快上线,完整模型权重将在完成安全评估与加固后于两周内开源。
为什么重要
这是智谱在开源大模型竞争中的一次关键加码。近期国产模型密集迭代,从 Kimi K3、DeepSeek V4 Pro 到阿里 Qwen3.8 旗舰权重开源,开源赛道竞争明显提速;GLM-5.3 以「基座不变、后训练提智」的方式重新跻身开源模型能力前列,将编程与智能体任务的标杆再次抬高。对企业读者而言,两周后的权重开源意味着可以在本地或私有化环境评估其编程与安全能力,而 ZCode、AutoClaw 等工具的同步上线则为开发团队提供了低门槛的试用路径。
尚待观察
官方公布的基准成绩与安全漏洞数据主要来自内部评测,有待第三方独立复测与开源社区验证;两周后权重开放时的实际部署成本、推理效率以及与闭源旗舰模型在真实工程场景中的差距,仍需进一步检验。此外,网络安全能力的「涌现」宣称涉及具体漏洞清单的公开范围,相关细节值得持续关注。

