行业新闻

智谱发布GLM-5.3 编程能力接近Claude Fable 5

智谱发布GLM-5.3 编程能力接近Claude Fable 5

GLM-5.3 以接近闭源顶尖模型的编程能力和可交付软件的安全审计能力,成为目前最强的开源模型之一。

GLM-5.3 是智谱最新开源模型,编程与智能体能力接近 Claude Fable 5,在基准测试中为排名最高的开源模型。其安全能力突出,联合多家机构进行红队测试,累计发现 2404 个漏洞(其中 1088 个中高危),并能在实际审计中自主找出并修复 12 类漏洞,通过 54 项回归测试。

正文摘录

昨儿 DeepSeek V4 Pro 正式版 + Harness、Grok 4.6“你方唱罢”,今儿 GLM-5.3 闪亮一记 “我登场” —— 一出手便杀回 开源一哥 、 国模一哥 ,甚至在 Coding 方面更加 接近 Claude Fable 5! 也就是说,唐杰给马斯克“画的饼”(说国产模型超越 Fable 5 不会太久),往前拱了一大截,也就花了 2 个月整。 在多项主流基准测试中,GLM-5.3 是当前 排名最高的开源模型 ,编程与智能体能力接近 Claude Fable 5,编程 体感 超过其他国产模型。 更值得注意的是不同推理强度下的表现。随着 Token 预算增加,GLM-5.3 的 Coding 准确率继续往上走;在 High 档位下,已经能以明显更低的 Token 消耗,做到超过 Claude Opus 4.8 最高档位的准确率。 在 CyberGym 白盒代码审查中,GLM-5.3 拿到 84.5%,相比 5.2 的 77.2% 继续提升,也略高于 Mythos 5 和 GPT-5.6 Sol,一举成为 最强开源安全模型 。 并且在 GLM-5.3 发布前两周,智谱就联合清华、南开,以及国内众多企业、实验室,开展了密集的红队测试与安全评估。 据悉,累计发现漏洞 2404 个(经过初筛、去重),其中 1088 个为中高危,覆盖系统内核、操作系统、浏览器引擎、开源基础组件、互联网应用与互联网协议等 220 个项目。 所以,这次智谱发布 GLM-5.3,两个关键词便一目了然了:一个是 Coding,另一个是安全。

阅读原文(qbitai.com)→

行业新闻十三2026-08-14原文

相关内容