智谱发布GLM-5.3,全球开源大模型格局又变
智谱发布GLM-5.3,全球开源大模型格局又变
2026年08月14日 14:59

【导读】 智谱 正式发布GLM-5.3,重新进入全球开源模型能力竞争前列
中国基金报记者卢鸰
国产开源大模型竞争正持续升温,呈现“你追我赶”的发展态势。
继月之暗面发布Kimi K3、DeepSeek发布DeepSeek V4 Pro之后, 智谱 于8月14日也发布了新一代基座模型GLM-5.3。该模型总参数规模为7430亿,主要通过后训练实现能力跃升,在编程能力和复杂工程执行等核心任务上取得突破。
根据 智谱 官方技术报告,GLM-5.3在Terminal-Bench 3.0取得28.3的开源最佳成绩,超过Kimi K3;在DeepSWE 1.1上得分达66.9。GLM-5.3由此重新进入全球开源模型能力竞争前列。
在多项主流基准测试中,GLM-5.3是当前排名最高的开源模型,编程与智能体能力接近Claude Fable 5,编程体感超过其他国产模型。
此外,测试结果显示,GLM-5.3在效果和Token利用率之间取得了更好的平衡。在High档位下,GLM-5.3达到31.4%的准确率,超过Claude Opus 4.8最高档位的29.5%,每项任务平均输出约5万tokens,而Opus 4.8需要约12万tokens,意味着GLM-5.3可以用更短的执行路径完成任务。
不过,此次升级的意义并不只在编程。随着大模型应用走向真实软件工程,行业竞争正在从“模型能不能写代码”进入“模型能不能完成复杂任务”。 网络安全 成为这一能力演进的重要方向。 网络安全 要求模型进一步理解复杂系统,包括程序逻辑、协议规则、权限边界和攻击路径,是代码能力向更高阶任务的延伸。
在CyberGym测试中,模型从白盒源代码出发,通过触发程序故障来识别和验证漏洞。GLM-5.3得分为84.5%,高于GLM-5.2的77.2%,也略高于Mythos 5的83.8%和GPT-5.6 Sol的83.6%。
模型发布前两周,智谱联合安全团队开展测试,发现2404个潜在漏洞,其中1088个为中高危。其中,研究人员借助GLM-5.3发现了潜伏40余年的DNS协议级风险,攻击者仅需少量特殊请求即可将服务器压力最高放大近8万倍,潜在影响超过1000万处公网DNS服务。这意味着,模型能力正在从Benchmark测试走向真实专业工作流。
在业内人士看来,对于基础模型公司而言,下一阶段的竞争不仅是模型能力竞争,更是高价值场景竞争。Coding Agent、安全审计、企业服务等方向,都可能成为模型商业化的重要入口。据了解,GLM-5.3将接入ZCode、Trae、WorkBuddy、Qoder、CawPaw和OpenCode等平台,API随后上线,并计划开放完整模型权重。
截至记者发稿,智谱股价为1203港元/股,最新市值为5601亿港元。
(文章来源:中国基金报)