国产开源大模型在八月中旬迎来密集更新。继月之暗面发布 Kimi K3、DeepSeek 发布 V4 Pro 之后,智谱于 8 月 14 日正式推出新一代基座模型 GLM-5.3。与以往靠堆参数不同,这一次的跃升几乎全部来自后训练阶段。

同基座、靠后训练拉开差距
GLM-5.3 总参数规模为 7430 亿,与 GLM-5.2 共享同一基座模型,所有能力提升都来自后训练 Scaling——可以理解为「课本没换,但换了更好的训练方法」。相较 GLM-5.2,其在编程能力上提升约 50%(基于智谱内部的 Z.ai Code Bench)。
在公开基准上,GLM-5.3 取得多项开源最佳:Terminal-Bench 3.0 得分 28.3,明显超过 Kimi K3 的 17.4,而 GLM-5.2 在该项仅 4.6;DeepSWE v1.1 软件工程基准得分 66.9(GLM-5.2 为 46.2,Kimi K3 为 67.5)。整体编程体感已逼近 Claude Fable 5 与 GPT-5.6 Sol 所处的第一梯队。
网络安全成意外亮点
更受关注的是能力的外溢。随着后训练规模放大,GLM-5.3 在网络安全方向涌现出了超出立项预期的能力:在 CyberGym 漏洞推理评测中得分 84.5%,高于 GLM-5.2 的 77.2%,也略高于 Mythos 5 的 83.8% 与 GPT-5.6 Sol 的 83.6%。
发布前两周,智谱联合安全团队开展测试,累计发现经去重后的潜在漏洞 2404 个,其中 1088 个为中高危。研究人员还借助该模型定位了一处潜伏 40 余年的 DNS 协议级风险——攻击者只需少量特殊请求,就能把服务器压力最高放大近 8 万倍,潜在影响超过 1000 万处公网 DNS 服务。
一个月,三家头部厂商集体迭代
GLM-5.3 并非孤例。就在此前一个月,月之暗面于 7 月 17 日发布总参数 2.8 万亿的 Kimi K3,DeepSeek 于 8 月 13 日上线总参数 1.6 万亿、每 token 激活约 490 亿的 V4 Pro。三家头部厂商在编程与复杂任务方向上集体逼近国际前沿。智谱表示,GLM-5.3 权重将在发布两周后开源,并计划接入 ZCode、Trae、Work、Qoder 等开发平台。
来源:智谱官方技术博客 z.ai / 中国基金报、证券时报等报道(2026-08-14)







